Open LMM Reasoning - MathVista - GPS — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1Doubao-1.5-Pro91.3
2InternVL3-78B86.1
3Gemini 2.0 Flash84.6
4Gemini 1.5 Pro (002)81.7
5Gemma 3 27B80.8
6InternVL3-38B80.3
7InternVL3-14B79.8
8Ovis2-8B78.4
9InternVL3-8B77.4
10QVQ-72B-Preview76.4
11Grok 2 (1212)74.5
12GPT-4o ChatGPT73.1
13InternVL2.5-78B72.1
14Claude 3.7 Sonnet72.1
15Gemma 3 12B71.6

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-gps · How the rankings work · Data refreshed daily, snapshot 2026-07-22.