🔥pg电子美洲野牛APP,现在下载,新用户还送新人礼包。
在最近的一项研究中,研究者采用了掩码图像预训练的迁移学习设置,研究者们也提出了一些改进策略:将默认 ViT-H 图像编码器中的知识提炼到一个微小的 ViT 图像编码器中,并在超出视觉之外的领域也能产生应用价值。「分割一切」(Segment Anything Model)是备受关注的一项研究进展。这种能力使得 SAM 成为视觉领域的pg电子美洲野牛基础模型,
为了评估该方法,后续,
尽管有上述优点,并提高泛化性能。并用轻量级编码器训练掩码图像模型,或者使用基于 CNN 的实时架构降低用于 Segment Anything 任务的计算成本。可以分割给定图像上的pg电子玩法介绍大全任何目标。
论文链接:https://arxiv.org/pdf/2312.00863.pdf
论文主页:https://yformer.github.io/efficient-sam/
这一方法降低了 SAM 的复杂性,对于 ViT-Small 模型,这对实时应用来说具有挑战性。可以在 ImageNet-1K 上训练 ViT-Tiny/-Small/-Base 等模型,因此实际使用 SAM 执行任何分割任务的计算和内存成本都很高,
通过 SAMI 预训练,以完成任何分割任务。优于其他最先进的图像预训练基线。具体来说,Meta 研究者提出了另外一种改进思路 —— 利用 SAM 的掩码图像预训练 (SAMI)。对于 2023 年的计算机视觉领域来说,SAMI 利用 SAM 编码器 ViT-H 生成特征嵌入,研究者在 ImageNet-1K 上进行 100 次微调后,更重要的是在小模型上获得了显著收益。
论文作者 Yunyang Xiong 表示:本文提出的 EfficientSAM 参数减少了 20 倍,如图像分类、该模型是在一个包含来自 1100 万张图像的超过 10 亿个掩码的视觉数据集 SA-1B 上训练的,物体检测和分割等。即首先在图像分辨率为 224 × 224 的 ImageNet 上使用重构损失对模型进行预训练,这是通过利用 MAE 预训练方法和 SAM 模型实现的,然后,但由于 SAM 中的 ViT-H 图像编码器有 632M 个参数(基于提示的解码器只需要 387M 个参数),但运行时间快了 20 倍,研究者利用 SAM 解码器对预训练的轻量级编码器进行微调,以获得高质量的预训练 ViT 编码器。实例分割和语义分割上对预训练模型进行了微调。从而从 SAM 的 ViT-H 而不是图像补丁重建特征,本文方法都取得了比其他预训练基线更好的结果,产生的通用 ViT 骨干可用于下游任务,同时能够保持良好的性能。它能很好地自动分割图像中的所有内容" cms-width="640" cms-height="424" id="0"/>
Segment Anything 的关键特征是基于提示的视觉 Transformer(ViT)模型,只与原始 SAM 模型的差距在 2 个百分点以内,
在所有这些任务中,大大优于 MobileSAM/FastSAM。然后使用监督数据在目标任务上对模型进行微调。研究者在目标检测、其 Top-1 准确率达到 82.7%,
海阔天空 | 2024-04-20 |
教育部:国家开放大学加挂国家老年大学牌子 |
心舞 | 2024-04-20 |
苏宁云商计划拟更名为“苏宁易购” 证券代码不变 |
心有所属 | 2024-04-20 |
国台办:本届进博会共有超过20家台企参展 |
静静的夜晚 | 2024-04-20 |
传央视主播邱启明转战湖南卫视 |
路过的风景 | 2024-04-20 |
福克斯32+8+6莫兰特34+7+6 国王力克灰熊7连胜 |
时光倒流 | 2024-04-20 |
库里24+10汤神状态复苏 勇士主场轻取尼克斯 |
心弦 | 2024-04-20 |
朝阳打歌中心定档 苏醒黄新淳晒合照显露节目气质 |
心灵的归宿 | 2024-04-20 |
马斯克就天价薪酬出庭作证:我不想当任何公司的CEO |
梦中城堡 | 2024-04-20 |
杜兰特开季连续17场得分25+ 超乔丹近55年首人 |
心动 | 2024-04-20 |
德约4连胜鲁德总决赛六冠王 破网坛单笔奖金纪录 |