模型智能能力 · 多维天梯

OCR 能力天梯

多模态模型图像文字提取准确率与鲁棒性评估

相关: PaddleOCR 目录 · OCR 模型搜索 · 图像处理榜

数据更新于 2026-07-31 · 能力库 206 条(网关 49 · 站外 157 · AA 173 · Arena 100 · 当前榜 1 · OpenRouter 实时已接入 · 知识库 159 模 / 31 族 / 26 维

OCR 能力天梯 配图

模型天梯 · modality

OCR 能力天梯

本榜评估多模态模型在光学字符识别(OCR)方面的能力,重点考察其从图像中准确提取文字、表格、公式等信息的能力。数据来源于 OCRBench、DocVQA 等专业基准测试、Arena 多模态对战结果以及实际 API 使用数据和启发式评估。解读时,较高得分表明模型在各种复杂场景下的 OCR 表现更优,适用于文档自动化、内容提取等任务。注意不同基准的侧重点不同,综合参考可获得更全面的模型画像。

  • 基准测试准确率(如 OCRBench、DocVQA 分数)
  • 跨语言、跨字体和复杂场景鲁棒性加权
  • 实际 API 用量与用户反馈整合
显示 1全量 1

列表 1 / 1(全库 1)· 点击「佐证」查看评分依据与测试题面

#模型厂商地区OCR 分相对说明证据源佐证
🥇PaddleOCR-VL-1.5-0.9B
PaddleOCR-VL-1.5-0.9B
other网关68
OCR / 文档
光学字符识别
catalogimage
查看佐证

启发式维度(中文/英文/OCR/软件等)在无官方公开 bench 时由厂商归属、模态与关联模型热度估算,仅供选型参考; 客观能力以 AA 智力/代码/Agent 与本站实测为准。交叉验证: 用量榜 · 模型目录 · 实验室

GrokCode OCR 能力天梯 | 多模态模型 OCR 性能排行榜 · GrokCode 倍率榜