Meta FAIR 发布

在图像与视频中分割任意对象

SAM 2 是一款分割模型,可在任意视频或图像中快速、精准地选择任意对象。
只需在任意图像或视频帧上点击、框选或使用遮罩。

什么是 SAM 2

SAM 2 是首个可在图像和视频中统一分割对象的模型。通过点击、框选或遮罩,即可在任意图像或视频帧上选择任意对象。

图像与视频统一模型

单一架构即可完成静态图像与视频帧的分割,结果稳定且高质量。

点击、框选或遮罩提示

使用任意提示方式精准选择对象,并可通过额外提示进一步精调预测结果。

可扩展的数据引擎

将标注从图像扩展到视频的数据引擎,支撑 SAM 2 的大规模训练。

开源且可复现

模型权重、推理代码与网页 Demo 均向研究者和开发者开放。

为什么选择 SAM 2

更快、更稳健、更易用的顶尖分割能力。

SAM 2 基于 Segment Anything 构建,图像分割质量进一步提升。

核心能力

分割任意对象,现在支持任意视频或图像。

跨帧选择

在视频帧中选择一个或多个对象,并跨帧调整预测结果。

零样本鲁棒性

对训练中未见过的对象与视频同样表现稳健,适用于广泛的真实场景。

实时交互

流式推理设计,支持高效、实时的交互式视频处理。

业界领先性能

在视频与图像对象分割上均取得顶尖结果。

简洁设计与快速推理

统一模型设计简洁,推理速度快。

图像与视频合二为一

Meta Segment Anything 的下一代,将图像与视频分割融为一体。

常见问题

关于 SAM 2、分割能力与如何上手的常见问题。







亲自体验

只需单击一帧,即可在任意视频中交互式追踪对象,并创作趣味效果。