header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

蚂蚁百灵金融模型正式开源:MIT许可,123道金融搜索题也放出

动察 Beating AI 快讯,蚂蚁百灵正式开源金融模型 Ling-3.0-flash-Fin。模型拥有 1240 亿总参数、51 亿激活参数,支持 256K 上下文。官方放出的 BF16 权重约 255GB,采用 MIT 许可证,可以用 vLLM 和 SGLang 自行部署。


一起开源的还有金融搜索基准 FinFIRST。它由蚂蚁集团开发,中金公司投行团队提供专业支持,50 多名金融专业人士参与出题和验证。最终只有 9.78% 的候选题通过筛选,留下 123 道题。其中 61.8% 需要计算,32.5% 需要同时查多个来源。


每道题会拆成多个评分点,分别检查 AI 有没有找对数据、用对信源、核准时间和统计口径,以及计算结果是否正确。整套数据共有 701 个细分评分点。现在题目、参考答案和评分标准全部公开,采用 Apache 2.0 许可证。

AI 解读
蚂蚁百灵把Ling-3.0-flash-Fin的权重和FinFIRST基准一并开源,且均采用宽松许可,这在国内大厂金融模型中不多见。从Ling-2.6到3.0系列,蚂蚁一直沿袭"小激活参数+MIT开源"路线,这次是首次将开源策略落到具体行业场景。

值得注意的是FinFIRST的组建方式:蚂蚁主导、中金投行参与出题,题目筛选率仅9.78%,且61.8%涉及计算。这意味着基准设计刻意规避了模型擅长但金融场景不常用的百科问答,而是用投行真实工作流——查多源数据、核时间口径、算结果——作为评分点。真正值得关注的信号在末尾:蚂蚁拉来中金而非纯学术机构共建基准,这与此前单纯堆通用Agent跑分的开源动作路径不同,指向金融行业模型开始用机构实务标准验收能力。
展开
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成