动察 Beating AI 快讯,蚂蚁百灵推出医疗健康模型 Ling-3.0-flash-Sante。它基于 Ling-3.0-flash 强化医疗能力,采用 MoE 架构,总参数 1240 亿,但每个 token 只激活约 51 亿参数。重点能力包括医学推理、药物安全、循证检索和长流程医疗研究。
百灵公布的评测里,Sante 在 DiagnosisArena-MCQ 拿到 83.8 分,高于 GPT-5.6 Sol 的 81.9、Kimi K3 的 78.4 和 Gemini 3.6 Flash 的 76.2。MedXpertQA-Text 得分 53.9,也略高于 Kimi K3 的 53.5,但仍低于 GPT-5.6 Sol 的 60.2 和 Gemini 3.6 Flash 的 62.4。
它也没有只刷医学选择题。百灵还测试了 BrowseComp、DeepSearchQA 和 HLE with tools,重点强化「自己查资料再回答」的能力。医疗伦理和安全也单独做了测试,MedEthicAlign 得分 82.1,内部安全测试 AFUSAFE-MedSCE 得分 78.6。
Sante 已经接入 OpenRouter 和 Vercel,可免费调用。