核心优势
- 文本驱动分割 — 用自然语言描述要分割的内容,无需手动标注点或框
- 图像和视频双支持 — 支持单张图像分割和视频序列跨帧追踪
- 多物体支持 — 使用逗号分隔的提示可同时分割和追踪多个物体
- 开放词汇 — 处理远超以往工作的开放词汇概念
限制: 模型文本提示的 token 上限为 32 个。为获得最佳结果,请保持提示简短并聚焦于目标物体。
SAM 3.1 分割工作流
1. 下载工作流
请更新你的 ComfyUI 到最新版本,然后前往工作流 -> 浏览模板,在 Utility 类别下找到 SAM 3.1 工作流。
SAM3:视频分割
使用 SAM3 模型从视频中分割出主要主体或内容,隔离特定对象或区域。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON 文件或在模板库中搜索“SAM3: Video Segmentation”
LoadVideo 节点:
drinking_unicorn.mp4
LoadVideo 节点 115 · drinking_unicorn.mp4SAM3:图像分割
使用 SAM3 模型从照片或图像中分割出主要主体或内容,隔离特定对象或区域。
在 Comfy Cloud 上运行
在 Comfy Cloud 中打开
下载工作流
下载 JSON 文件或在模板库中搜索“SAM3: Image Segmentation”
LoadImage 节点:
neon_guitarist.png
LoadImage 节点 79 · neon_guitarist.png
2. 下载模型
SAM 3.1 模型托管在 Comfy-Org SAM 3.1 模型仓库。 放置到以下目录结构:3. 使用工作流
图像分割:- 图像:通过
Load Image节点加载图像(放入 ComfyUI 的input/文件夹) - 物体提示:要分割物体的简短文本描述,例如
person、car、cat - 输出为图像的遮罩,RGBA 预览显示分割结果
- 视频:通过
Load Video节点加载视频 - 物体提示:同上,描述要在各帧之间追踪和分割的物体的简短文本
- 输出包含每帧的遮罩和边界框
如需分别提示多个主体,用逗号分隔,并使用
:N 指定每个提示检测的最大物体数量:
eye:2, window panels:4
了解 Subgraph
本工作流使用了 Subgraph 节点实现模块化处理。查阅 Subgraph 文档了解如何自定义和扩展工作流。
补充说明
- 保持提示简短而具体 — 模型每个提示有 32 个 token 的限制
- 多物体检测 — 使用逗号分隔不同物体类型,用
:N限制每种类型的检测数量 - 分割遮罩 — 输出遮罩可作为其他工作流的输入(例如修复、背景移除)
- 更新需求 — 确保 ComfyUI 已更新到最新版本以支持 SAM 3.1