Benchmark

MMVetGPT4Turbo

vision multimodal reasoning general spatial_reasoning math multimodal

MM-Vet evaluation using GPT-4 Turbo for scoring. This variant of MM-Vet examines large multimodal models on complicated multimodal tasks requiring integrated capabilities across six core vision-language abilities: recognition, knowledge, spatial awareness, language generation, OCR, and math.

语言EN
满分1
参评模型1

模型排名

名次 模型 机构 分数 来源
1 Qwen2-VL-72B-Instruct Alibaba Cloud / Qwen Team 74.0 来源 ↗