AI 快讯 编译自 the_decoder #模型发布#OCR#文档处理

Mistral 发布 OCR 4 模型:盲测 72% 胜率,文档识别能力超越竞品

Mistral AI 推出 OCR 4 模型,专用于从 PDF、Word、PPT 等文档中提取文字。据公司称,在盲测中该模型以 72% 的胜率击败竞品。本文详解其技术细节、性能表现,并分析对中文用户的实际价值与国产替代方案。

编译发布 2026/06/24 原文发布 2026/06/24

一句话看懂

Mistral AI 发布 OCR 4 模型,在盲测中以 72% 胜率击败竞品,专用于从 PDF、Word、PPT 等文档中提取文字。

详细发生了什么

Mistral AI 于 2026 年 6 月 24 日发布了 OCR 4 模型。这是一款专门从 PDF、Word 文件和 PowerPoint 演示文稿等文档中读取文本的模型。据公司官方声明,在盲测中,OCR 4 在 72% 的测试案例中优于竞争对手。

OCR(光学字符识别)技术长期以来一直是文档数字化的核心工具。但传统 OCR 在处理复杂布局、手写文字或低质量扫描件时往往表现不佳。Mistral 的 OCR 4 模型利用其在大语言模型(LLM)领域的积累,将文档理解提升到新高度。

虽然 Mistral 没有公布具体的基准测试细节,但盲测结果暗示该模型在多种文档类型和语言上具有显著优势。OCR 4 的发布正值企业数字化转型加速之际,高效准确的文档解析能力对于自动化工作流、数据提取和知识管理至关重要。

中文圈视角

对于中文用户,OCR 4 的发布有几点值得关注:

  1. 中文文档支持:Mistral 的模型通常对多语言支持较好,但中文手写体、竖排文字、混合排版(如中英文混排)仍是 OCR 的难点。目前国内主流 OCR 服务如百度 OCR、腾讯 OCR 以及开源项目 PaddleOCR 在中文场景下表现成熟,Mistral OCR 4 能否在中文上超越它们尚待验证。

  2. 使用门槛:Mistral 的模型通常通过 API 或开源模型提供。如果 OCR 4 以 API 形式发布,国内用户可能需要考虑网络访问问题(需梯子)。相比之下,国内服务如百度 OCR 提供免费额度且无需特殊网络。

  3. 国产平替:国内已有多个 OCR 方案,如 PaddleOCR(百度开源)、阿里云 OCR、腾讯 OCR 等,在中文文档处理上积累深厚。Mistral OCR 4 的优势可能在于对英文、法文等西方语言的更好支持,以及更强大的上下文理解能力(例如从复杂表格中提取结构化数据)。

  4. 合规风险:如果涉及敏感文档(如合同、身份证),数据出境是必须考虑的问题。国内用户应优先选择本地部署或合规的国内服务。

几条值得记住的细节

  • OCR 4 是 Mistral 专门为文档文字提取设计的模型,而非通用 LLM。
  • 盲测中 OCR 4 在 72% 的案例中击败竞品,但具体测试集和竞品列表未公开。
  • 模型支持 PDF、Word、PowerPoint 等常见文档格式。
  • 目前 Mistral 尚未公布 OCR 4 的定价和 API 访问方式。
  • 该模型可能通过 Mistral 的 Le Chat 平台或 API 提供。

一句话总结

Mistral OCR 4 在文档识别上表现亮眼,但中文用户需评估其对中文的支持程度,并考虑国内成熟替代方案。