MMStar — leaderboard

MMStar evaluates vision-indispensable multimodal capabilities across perception, reasoning, STEM, and math axes.

Metric: Accuracy (%). Source: huggingface.co. Status: saturation imminent. 284 models tracked.

Top models

#ModelScore
1GPT-5 (2025-08-07)75.7
2Gemini 2.5 Pro73.6
3InternVL3-78B73.4
4GPT-5 Mini (2025-08-07)73.2
5InternVL3-38B72.6
6Doubao-1.5-Pro71.9
7GPT-4o ChatGPT70.2
8GPT-4.1 (2025-04-14)69.8
9InternVL2.5-78B69.5
10Gemini 2.0 Flash69.4
11GPT-4.569.3
12InternVL3-14B68.9
13InternVL3-8B68.7
14Qwen 2 VL 72B68.6
15GPT-5 Nano68.3

Interactive version: theaggregate.ai/benchmark?slug=mmstar · How the rankings work · Data refreshed daily, snapshot 2026-07-22.