动察 Beating AI 快讯,蚂蚁百灵(InclusionAI)发布全新 Flash 模型 Ling-3.1-flash。模型约有 560B 总参数,每个 token 只激活约 25B,最高可扩展到 1M 上下文。相比 Ling-3.0-flash 的 124B 总参数、5.1B 激活参数,这一代总规模扩大约 4.5 倍,单 token 激活参数接近 5 倍。
百灵这次还重点展示了长时间编码能力。官方称,Ling-3.1-flash 连续约 17 小时从零写出一个 Lua 到 x86-64 ELF 编译器,182 项测试通过 178 项,成功率 97.8%。另一次约 20 小时的任务中,它把一个 C 图像库移植到 Rust,最终做到 8.015 倍加速,30 项正确性检查全部通过。
模型已经可以通过 Novita AI 和 Vercel AI Gateway 体验。免费体验持续两周,目前只开放约 256K 上下文,完整的 1M 还没上线。百灵称,后续转为付费服务后会开放 1M 上下文,并计划同步开源模型。