Open LMM Reasoning - MathVista - ARI — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1InternVL3-78B74.5
2InternVL3-38B73.7
3Doubao-1.5-Pro72
4InternVL3-14B68
5Grok 2 (1212)67.1
6Ovis2-8B66.6
7InternVL2.5-78B66.6
8GPT-4o ChatGPT66.6
9GPT-4.1 (2025-04-14)65.7
10InternVL3-8B64.6
11GPT-4.1 Mini64
12QVQ-72B-Preview64
13Claude 3.7 Sonnet62.9
14Qwen 2 VL 72B62.6
15Gemini 2.0 Flash61.2

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-ari · How the rankings work · Data refreshed daily, snapshot 2026-07-22.