header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

基元律动开源4B决策模型NeoHorse-Jev,开源 Jev 综合评测第一

动察 Beating AI 快讯,前华为盘古大模型负责人王云鹤创办的基元律动开源 NeoHorse-Jev-4B,把自家的 NeoHorse-1-4B 做成了一款 Jev 同类决策模型。它不需要逐字生成答案,而是直接在几个候选项里做选择、判断是非或打分,主要用来给 Agent 选工具、做路由和决定下一步动作。


官方汇总了 JevBench、Kev、OpenJev 等 6 组文本评测。NeoHorse-Jev-4B 的等权平均分为 77.70,高于 9B 参数 Open-Jev 的 75.67,也超过 Kev-4B 的 74.25。不过这个综合分由基元律动自行汇总,目前只有 4 款开源模型六项成绩完整,NeoHorse-Jev 也只在其中两组拿到最高分。


它基于 NeoHorse-1-4B,通过 prefill-only 推理直接计算候选答案的概率,省掉普通大模型逐字生成文本的过程。在 1158 个文本请求的测试中,32 并发时服务端平均一次决策耗时 74.3ms;256 并发时吞吐达到每秒 347.05 个请求。


模型支持文本以及单张图片输入,权重、推理代码和部署示例均已开放,可通过 vLLM、SGLang 或本地 Runtime 运行,采用 Apache 2.0 许可。

AI 解读
Jev带火的“不生成、只判断”System One路线,正外溢到开源小模型。前华为盘古大模型负责人王云鹤创办的基元律动,基于NeoHorse-1-4B开源NeoHorse-Jev-4B,切入Agent选工具、路由和下一步动作。9月16日Jev发布后,Cua、斯坦福与英伟达接连开源同类模型,竞争转向参数、延迟与吞吐。

“综合第一”需拆开:官方汇总六组等权均分77.70,高于9B Open-Jev的75.67、Kev-4B的74.25;但仅4款模型六项完整,NeoHorse-Jev只在两组登顶。它用prefill-only直接算候选概率,256并发吞吐347.05请求/秒,Apache 2.0,支持vLLM/SGLang。4B开源可部署,抢的是Agent决策层默认件。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成