Open LMM Reasoning - MathVista - NUM — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4o ChatGPT59.7
2Doubao-1.5-Pro56.2
3InternVL3-78B55.6
4GPT-4.1 (2025-04-14)52.8
5Qwen 2 VL 72B51.4
6InternVL3-38B50.7
7Gemini 2.0 Flash50
8InternVL3-14B48.6
9Gemini 1.5 Pro (002)47.2
10InternVL3-8B46.5
11GPT-4.1 Mini45.1
12InternVL2.5-78B45.1
13Grok 2 (1212)45.1
14Ovis2-8B43.8
15MiniCPM-V-2.641.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-num · How the rankings work · Data refreshed daily, snapshot 2026-07-22.