亚洲财经

搜索

Jina魔改DeepSeek-OCR,自测14款里页面吞吐第一

Jina发布了文档解析模型jina-ocr-v1,该模型能够将PDF、扫描件、表格和图表直接转换为Markdown。它基于deepseek-ocr进行后训练,使用约34亿总参数,并在解码时每个token激活约5.7亿参数的MOE架构,加入了fastmtp推测解码。在自测中,jina-ocr-v1在omnidocbench v1.6得分91.14,比deepseek-ocr-2高0.89分在olmocr-bench得分83.4,比其基础的deepseek-ocr底模高7.4分。吞吐量是Jina的主要卖点之一,单张A100、并发32时,达到2.57页/秒,成为Jina测试的14个系统中最高的,较deepseek-ocr的2.10页/秒高出约22%。模型权重已上传至Hugging Face,采用CC BY-NC 4.0许可,商业使用需联系Jina。