OpenVLM MathVista - ARI: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 284 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro75.9
2InternVL3-78B74.5
3InternVL3-38B73.7
4GPT-572.2
5Doubao-1.5-Pro72
6GPT-5 Mini (2025-08-07)71.7
7InternVL2.5-78B-CoT68.8
8Grok 2 (1212)67.1
9InternVL2.5-78B66.6
10GPT-4o ChatGPT66.6
11GPT-4.1 (2025-04-14)65.7
12GPT-4.565.2
13InternVL2.5-26B-CoT64.9
14InternVL3-8B64.6
15Taichu-VLR-7B64.6

Interactive version: theaggregate.ai/benchmark?slug=openvlm-mathvista-ari · How It Works · Data refreshed daily, snapshot 2026-09-05.