header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Meta把SAM 3.1做成API,千张图分割只要2.5美元

动察 Beating AI 快讯,Meta 把视觉分割模型 SAM 3.1 正式接入 Model API。开发者传入图片或视频,再输入「红色自行车」之类的短语,就能直接找出对应物体,返回边界框和像素级蒙版。视频里还能一路跟踪同一个目标,方便自动打码、加特效等。


Meta 今年 3 月已经发布开放权重版本的 SAM 3.1。相比 SAM 3,它最大的升级是 Object Multiplex,以前多个目标要逐个处理,现在一次最多可以同时处理 16 个。Meta 测试中,一张 H100 处理多目标视频的速度从每秒 16 帧提高到 32 帧;追踪 128 个目标时,速度约为 SAM 3 的 7 倍。


以前开发者需要自己下载权重、准备 GPU 和部署环境,现在可以直接走 Meta 托管的 API。图片分割每 1000 张收费 2.5 美元,视频每 1000 帧收费 0.2 美元,还可以直接用 OpenAI SDK 接入。


不过 API 版目前只接受文字提示,开放权重版还能用框、点等视觉提示来指定目标。视频 API 每帧最多追踪 16 个物体。

AI 解读
Meta 今年 3 月已放出 SAM 3.1 开放权重,现接入 Model API:图片每 1000 张 2.5 美元、视频每 1000 帧 0.2 美元,兼容 OpenAI SDK。视觉分割从权重分发转向托管货架,Meta 用低价和标准接口抢开发者入口。

近期 DeepSeek 开放视觉理解 API,商汤开源检测分割统一模型,OpenRouter 聚合视频生成接口;Muse Spark 1.1 也已登陆 OpenRouter。模型层竞争正从跑分转向 API 分发与单位成本。

末尾细节更关键:API 版只接受文字提示,开放权重才支持框、点;视频 API 每帧最多追踪 16 个物体,而官方测试称追踪 128 个目标时速度约为 SAM 3 的 7 倍。托管版能力被切片,高阶控制仍留在自托管。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成