Benchmark

OCRBench-V2 (en)

vision image-to-text multimodal

OCRBench v2 English subset: Enhanced benchmark for evaluating Large Multimodal Models on visual text localization and reasoning with English text content

语言EN
满分1
参评模型2

模型排名

名次 模型 机构 分数 来源
1 Qwen2.5 VL 72B Instruct Alibaba Cloud / Qwen Team 61.5 来源 ↗
2 Qwen2.5 VL 32B Instruct Alibaba Cloud / Qwen Team 57.2 来源 ↗