EuroEval Catalan Knowledge — leaderboard

Metric: Knowledge Average Score (%). Source: euroeval.com. 195 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)86.28
2GPT-584.93
3Grok 4.20 Beta (0309) (Reasoning)84.78
4Gemini 3 Flash (Preview) (Non-reasoning)84.53
5GPT-5.4 Mini (High)83.91
6GPT-5.4 Mini (Medium)80.97
7Gemini 2.5 Pro80.95
8Claude Sonnet 4.5 (Thinking)80.6
9GPT-5 Mini80.59
10Grok 4.1 Fast (Reasoning)80.35
11Gemini 2.5 Flash (Thinking)79.92
12GPT-5.278.59
13Claude Sonnet 4.5 (Non-reasoning)78.12
14Qwen 3.5 9B77.67
15Gemini 2.5 Flash Lite (Thinking)77.23

Interactive version: theaggregate.ai/benchmark?slug=euroeval-catalan-knowledge · How the rankings work · Data refreshed daily, snapshot 2026-07-22.