首页/问答百科/Segment Anything
🧠 模型与架构

Segment Anything

SAMSAM模型Segment Anything ModelMeta SAM

Segment Anything(SAM)是Meta于2023年发布的通用图像分割基础模型,通过提示工程(点、框、文本)实现零样本分割任意物体,是计算机视觉领域的里程碑式基础模型。


Segment Anything 简介

Segment Anything Model(SAM)由 Meta AI 于 2023 年发布,是一个提示驱动的图像分割基础模型,能够在没有微调的情况下分割图像中的任意物体。

核心组件

SAM 由三大组件构成:图像编码器(MAE 预训练的 ViT-H)处理图像生成嵌入特征;提示编码器编码交互式提示(点、边界框、掩码或文本描述);轻量级掩码解码器融合图像嵌入和提示嵌入,输出分割掩码。

训练数据

SAM 发布了 SA-1B 数据集——包含 1100 万张图像、11 亿个高质量分割掩码。通过数据引擎逐步扩增标注规模。

零样本能力

SAM 展现了强大的零样本迁移能力:无需额外训练即可在未见过的图像分布(医学影像、卫星图、显微镜图像)上进行分割。SAM 被视为视觉领域的 GPT 时刻,启发了 SAM 2(视频分割)、MobileSAM、FastSAM 等一系列后续工作。


相关术语

分享: