SAM 3 / 3.1 是什么?
SAM 3 是 Meta Segment Anything Model 系列的新模型。
以前的 SAM 主要只是 理解物体的形状。如果想切出指定对象,需要用 BBOX 或坐标来指定位置。
SAM 3 则可以像 VLM 一样用文本指定对象,并且单独完成分割。
SAM 3.1 是 SAM 3 的更新版,改进了视频中多个对象的追踪处理。
模型下载
- sam3.1_multiplex_fp16.safetensors (1.75 GB)
📂ComfyUI/
└── 📂models/
└── 📂checkpoints/
└── sam3.1_multiplex_fp16.safetensors
workflow
静态图像

- 向
SAM3 Detect节点输入图像、蒙版,以及想切出的对象信息(文本提示词、BBOX、坐标)。 - 这个规格有点绕。如果有多个对象符合提示词,只写
car的话,只会检测其中最像的一个。- 如果想分割到第 N 个对象,需要写成
car:N。 - 如果只是想检测画面中所有符合条件的对象,直接写成
car:99也可以。
- 如果想分割到第 N 个对象,需要写成
视频
- 使用
SAM3 Video Track节点。 - 将输出传给
SAM3 Track to Mask节点,就可以作为蒙版使用。 SAM3 Track Preview节点输入图像和track_data后,会给蒙版部分上色,方便查看。