SAM 2 是首个可在图像和视频中统一分割对象的模型。通过点击、框选或遮罩,即可在任意图像或视频帧上选择任意对象。
单一架构即可完成静态图像与视频帧的分割,结果稳定且高质量。
使用任意提示方式精准选择对象,并可通过额外提示进一步精调预测结果。
将标注从图像扩展到视频的数据引擎,支撑 SAM 2 的大规模训练。
模型权重、推理代码与网页 Demo 均向研究者和开发者开放。
更快、更稳健、更易用的顶尖分割能力。
分割任意对象,现在支持任意视频或图像。
在视频帧中选择一个或多个对象,并跨帧调整预测结果。
对训练中未见过的对象与视频同样表现稳健,适用于广泛的真实场景。
流式推理设计,支持高效、实时的交互式视频处理。
在视频与图像对象分割上均取得顶尖结果。
统一模型设计简洁,推理速度快。
Meta Segment Anything 的下一代,将图像与视频分割融为一体。
关于 SAM 2、分割能力与如何上手的常见问题。