Open LMM Reasoning - MathVista - SCI — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 100 models tracked.

Top models

#ModelScore
1GPT-4.1 Mini77.9
2GPT-4.1 (2025-04-14)76.2
3GPT-4o ChatGPT74.6
4InternVL3-14B73.8
5Claude 3.5 Sonnet (20241022)73.8
6InternVL3-38B73
7Gemini 2.0 Flash73
8InternVL3-78B72.1
9Gemini 1.5 Pro (002)72.1
10InternVL2.5-78B72.1
11Doubao-1.5-Pro70.5
12Ovis2-8B69.7
13Qwen 2 VL 72B68
14Claude 3.7 Sonnet68
15InternVL3-8B67.2

Interactive version: theaggregate.ai/benchmark?slug=open-lmm-reasoning-mathvista-sci · How the rankings work · Data refreshed daily, snapshot 2026-07-22.