OpenVLM MathVista - ARI — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro75.9
2InternVL3-78B74.5
3InternVL3-38B73.7
4GPT-5 (2025-08-07)72.2
5GPT-5 Mini (2025-08-07)71.7
6InternVL3-14B68
7Grok 2 (1212)67.1
8Ovis2-8B66.6
9InternVL2.5-78B66.6
10GPT-4o ChatGPT66.6
11GPT-4.1 (2025-04-14)65.7
12GPT-4.565.2
13InternVL3-8B64.6
14GPT-4.1 Mini64
15Claude 3.7 Sonnet62.9

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mathvista-ari · How the rankings work · Data refreshed daily, snapshot 2026-07-22.