Open LMM Reasoning - MathVista - MWP — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1InternVL3-78B91.4
2InternVL3-14B89.2
3InternVL3-38B88.2
4Grok 2 (1212)85.5
5Doubao-1.5-Pro84.9
6InternVL3-8B83.3
7Ovis2-8B82.3
8Claude 3.7 Sonnet78.5
9InternVL2.5-78B78
10Qwen 2 VL 72B71
11GPT-4.1 (2025-04-14)71
12QVQ-72B-Preview70.4
13GPT-4.1 Mini68.3
14GPT-4o ChatGPT68.3
15Aquila-VL-2B67.7

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-mwp · How the rankings work · Data refreshed daily, snapshot 2026-07-22.