Open LMM Reasoning - MathVista - VQA — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT64.2
2InternVL3-78B63.7
3InternVL3-38B62.6
4Doubao-1.5-Pro61.5
5Qwen 2 VL 72B59.8
6Gemini 2.0 Flash59.2
7GPT-4.1 (2025-04-14)58.1
8Qwen 2 VL 7B57
9InternVL2.5-78B57
10GPT-4.1 Mini55.3
11Ovis2-8B55.3
12InternVL3-14B54.7
13QVQ-72B-Preview53.6
14InternVL3-8B53.1
15Gemini 1.5 Pro (002)52.5

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-vqa · How the rankings work · Data refreshed daily, snapshot 2026-07-22.