header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Kimi研究员质疑NaiveAI,2000tok/s证明不了「AI造AI」

动察 Beating AI 快讯,清华大学副教授代季峰创办的 NaiveAI 刚发布首款模型 N0.5-Flash。公司主打「AI 参与研发 AI」,称模型参与了架构设计、代码编写和推理优化。官方公布的单流推理峰值达到 2122 tok/s。


月之暗面研究员杨新宇随后公开质疑这套宣传。他认为,2000 tok/s 本身完全可能做到,但 NaiveAI 选的对比基线太弱。它拿 SGLang 的 300 多 tok/s 做参照,小米此前已经让参数更大的 MiMo-V2.5-Pro 跑到 1000 tok/s 以上。基线选得低,最后的提升幅度自然更显眼。


杨新宇也不认可 NaiveAI 对架构创新的描述。N0.5-Flash 基于小米 MiMo-V2.5 Base 改造,把原来的全局注意力换成 DSA。NaiveAI 最后用了 DSA + GQA。杨新宇认为,这更多是基于现有底模做出的工程取舍,还会损失 GPU 利用率,算不上多大的架构突破。


他认为 NaiveAI 证明了模型可以靠继续训练和工程优化变快,但目前还没证明「AI 参与研发」本身带来了人类团队做不到的突破。

AI 解读
代季峰创办的NaiveAI开源N0.5-Flash,主打AI参与架构设计、写码与推理优化,模型基于小米MiMo-V2.5 Base,改注意力后继续训练3.25万亿tokens并开放权重。月之暗面杨新宇质疑:2122 tok/s拿SGLang 300多当基线,小米6月已让参数更大的MiMo-V2.5-Pro在标准8卡节点跑出1000+ tok/s;DSA+GQA更像工程取舍,还牺牲GPU利用率。

更值得注意的是,小米9月22日已发MiMo-V2.6,NaiveAI六天后仍改造V2.5 Base。开源底模与系统优化正压低“自研模型”门槛,“AI造AI”的叙事先被速度数字放大。杨新宇实质指出:当前只证明继续训练和工程优化能变快,未证明AI参与研发带来人类团队做不到的突破。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成