header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

AI开始集体放弃聊天?Needle 3只做工具调用,最小9MB就能跑

动察 Beating AI 快讯,YC S25 端侧 AI 公司 Cactus Compute 发布 Needle 3,专门做工具调用和结构化提取,不负责普通聊天。比如用户说「把客厅灯调到 30%」,它只需要找到对应功能,再把「客厅」和「30%」填进参数。


它和最近很火的 Jev 有点像,但路线不同。Jev 直接给候选决策打分;Needle 3 还是逐 Token 生成,只是输出被限制成程序能直接执行的工具调用。


Needle 3 一套权重可以裁成 2 到 20 层。2 层版本约 9MB,完整 20 层约 35MB,可以按手表、树莓派、手机等不同设备的算力来选。


针对安卓操作指令单独微调后,4 层、2900 万参数版本自测得分 62.5,超过 DeepSeek V4 Flash 的 60.5。

AI 解读
Cactus Compute 发布 Needle 3,只做工具调用和结构化提取:不聊天,把“把客厅灯调到 30%”拆成函数与参数。权重可在 2—20 层间裁剪,2 层约 9MB、20 层约 35MB,按手表、树莓派、手机算力分发。云侧 DeepSeek V4 Flash 靠极低成本在 OpenCode 两个月跑出 90 万亿 Token,Vercel 上 Token 份额 17%,成本仅占 1%。Needle 3 最扎眼的是 4 层、2900 万参数安卓指令自测 62.5,超过 DeepSeek V4 Flash 的 60.5;虽是单一窄任务自测,却说明专用小模型已能在执行层切走通用大模型调用。Jev 做候选打分,Needle 3 做受限逐 Token 生成,Claude Cowork 式工作流把模型当执行单元。对话不再入口,工具调用才是 Agent 的最后一跳。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成