Open LMM Reasoning - MathVista - ARI: leaderboard
Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | InternVL3-78B | 74.5 |
| 2 | InternVL3-38B | 73.7 |
| 3 | Step-1o | 72.8 |
| 4 | Ovis2-34B | 72.2 |
| 5 | Doubao-1.5-Pro | 72 |
| 6 | SenseNova | 71.7 |
| 7 | InternVL2.5-78B-MPO | 70.8 |
| 8 | Qwen2.5-VL-72B | 70.5 |
| 9 | InternVL2.5-38B | 70 |
| 10 | Ovis2-4B | 69.7 |
Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-ari · How It Works · Data refreshed daily, snapshot 2026-09-05.