header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Jina魔改DeepSeek-OCR,自测14款里页面吞吐第一

动察 Beating AI 快讯,Jina AI 发布文档解析模型 jina-ocr-v1,可以把 PDF、扫描件、表格和图表直接转成 Markdown。它基于 DeepSeek-OCR 做后训练,沿用其约 34 亿总参数、解码时每个 Token 激活约 5.7 亿参数的 MoE 架构,并加入 FastMTP 推测解码。


Jina 自测中,jina-ocr-v1 在 OmniDocBench v1.6 得 91.14,比 DeepSeek-OCR-2 高 0.89 分;在 olmOCR-Bench 得 83.4,比它实际基于的 DeepSeek-OCR 底模高 7.4 分。


吞吐量是 Jina 主打的卖点之一。单张 A100、并发 32 时,它达到 2.57 页/秒,在 Jina 测试的 14 个系统中最高,比 DeepSeek-OCR 的 2.10 页/秒高约 22%。


模型权重已经放上 Hugging Face,采用 CC BY-NC 4.0,商业使用需要联系 Jina。

AI 解读
Jina AI 发布 jina-ocr-v1,基于 DeepSeek-OCR 后训练,沿用约 34 亿总参数、每 Token 激活约 5.7 亿的 MoE,加 FastMTP 推测解码,把 PDF、扫描件、表格和图表转 Markdown。近期百度 Unlimited-OCR、阿里 OvisOCR2 接连刷新 OmniDocBench v1.6,后者达 96.58。Jina 自测 91.14 不占优,改推吞吐:单张 A100、并发 32 下 2.57 页/秒,较 DeepSeek-OCR 的 2.10 页/秒高约 22%,在自测 14 个系统中第一。

关键细节是许可:权重上 Hugging Face,却用 CC BY-NC 4.0,商用需联系 Jina。与百度、阿里接连开源冲榜不同,这是用开放权重换验证、把商用授权留在手里;吞吐能否落地企业,仍看授权与成本。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成