AA MMMU-Pro — leaderboard

Artificial Analysis independent evaluation of MMMU-Pro: multimodal understanding across 30 academic disciplines, eliminating shortcut strategies.

Metric: Accuracy (%). Source: artificialanalysis.ai. Status: saturated. 228 models tracked.

Top models

#ModelScore
1Human Expert85.4
2Gemini 3.5 Flash (High)84.28
3Gemini 3.5 Flash (Medium)83.87
4GPT-5.6 Sol (Max)83.41
5GPT-5.6 Sol (xHigh)82.66
6Gemini 3.1 Pro (Preview)82.43
7GPT-5.6 Sol (High)81.85
8GPT-5.6 Sol (Medium)81.39
9GPT-5.5 (Medium)81.16
10GPT-5.5 (High)81.1
11GPT-5.6 Sol (Low)80.98
12GPT-5.6 Terra (Max)80.69
13Kimi K380.52
14Muse Spark80.52
15Qwen 3.7 Plus80.46

Interactive version: theaggregate.ai/benchmark?slug=aa-mmmu-pro · How the rankings work · Data refreshed daily, snapshot 2026-07-22.