Kaggle Global-MMLU-Lite - Culturally Sensitive: leaderboard

Metric: Accuracy (%). Source: www.kaggle.com. 37 models tracked.

Top models

#ModelScore
1Claude Opus 595.44
2Gemini 3.8 Flash95.19
3Gemini 3.7 Flash94.72
4Gemini 3.5 Flash94.47
5GPT-5.6 Sol94.31
6Gemini 3 Pro (Preview)93.97
7Gemini 3.6 Flash93.94
8Claude Opus 4.893.87
9Grok 4.593.39
10Claude Opus 4.193.31
11GPT-5.6 Terra93
12GPT-692.91
13Gemini 2.5 Pro92.41
14Gemini 2.5 Flash90
15Gemma 4 31B89.25

Interactive version: theaggregate.ai/benchmark?slug=kaggle-global-mmlu-lite-culturally-sensitive · How It Works · Data refreshed daily, snapshot 2026-09-19.