MMMU-Pro: leaderboard

MMMU-Pro evaluates expert-level multimodal understanding with vision and standard variants derived from the MMMU benchmark.

Metric: Accuracy (%). Source: artificialanalysis.ai. 286 models tracked.

Top models

#ModelScore
1GPT-6 Astra (Max)86.88
2GPT-6 Astra (High)86.42
3GPT-6 Astra (xHigh)86.24
4GPT-6.1 Sol (Max)85.95
5Gemini 3.8 Flash (High)85.61
6Gemini 3.7 Flash (High)85.49
7GPT-6 Astra (Medium)85.09
8GPT-6.1 Sol (xHigh)85.09
9GPT-6.1 Sol (High)84.91
10Gemini 3.7 Flash (Low)84.86
11Claude Opus 5 (Max)84.74
12Gemini 3.7 Flash (Medium)84.74
13GPT-6 Astra (Low)84.62
14Gemini 3.8 Flash (Low)84.51
15Gemini 3.5 Flash (High)84.28

Interactive version: theaggregate.ai/benchmark?slug=mmmu-pro-9jqd0n · How It Works · Data refreshed daily, snapshot 2026-10-09.