Segment Anything 简介
Segment Anything Model(SAM)由 Meta AI 于 2023 年发布,是一个提示驱动的图像分割基础模型,能够在没有微调的情况下分割图像中的任意物体。
核心组件
SAM 由三大组件构成:图像编码器(MAE 预训练的 ViT-H)处理图像生成嵌入特征;提示编码器编码交互式提示(点、边界框、掩码或文本描述);轻量级掩码解码器融合图像嵌入和提示嵌入,输出分割掩码。
训练数据
SAM 发布了 SA-1B 数据集——包含 1100 万张图像、11 亿个高质量分割掩码。通过数据引擎逐步扩增标注规模。
零样本能力
SAM 展现了强大的零样本迁移能力:无需额外训练即可在未见过的图像分布(医学影像、卫星图、显微镜图像)上进行分割。SAM 被视为视觉领域的 GPT 时刻,启发了 SAM 2(视频分割)、MobileSAM、FastSAM 等一系列后续工作。