MMStar: leaderboard

MMStar evaluates vision-indispensable multimodal capabilities across perception, reasoning, STEM, and math axes.

Metric: Accuracy (%). Source: huggingface.co. Status: saturation imminent. 284 models tracked.

Top models

#ModelScore
1GPT-575.7
2Gemini 2.5 Pro73.6
3InternVL3-78B73.4
4GPT-5 Mini (2025-08-07)73.2
5InternVL3-38B72.6
6Doubao-1.5-Pro71.9
7GPT-4o ChatGPT70.2
8GPT-4.1 (2025-04-14)69.8
9InternVL2.5-78B69.5
10Gemini 2.0 Flash69.4
11GPT-4.569.3
12InternVL3-8B68.7
13Qwen 2 VL 72B68.6
14GPT-5 Nano68.3
15Gemini 1.5 Pro (002)67.1

Interactive version: theaggregate.ai/benchmark?slug=mmstar · How It Works · Data refreshed daily, snapshot 2026-09-05.