EuroEval Hungarian Summarization - Hunsum — leaderboard

Metric: Score (%). Source: euroeval.com. 149 models tracked.

Top models

#ModelScore
1GPT-4.134.8
2Gemini 3 Pro (Preview)34.53
3Apertus-70B-Instruct-250933.96
4Gemini 3 Flash (Preview) (Non-reasoning)33.91
5Mistral Small 3.133.66
6Gemini 2.5 Flash Lite (Non-reasoning)33.65
7Gemma 3 27B (IT)33.49
8Mistral Small 3.233.46
9GPT-5.4 Mini (Non-reasoning)33.46
10Gemma 4 31B (IT)33.42
11GPT-5.4 Mini (High)33.39
12Claude Sonnet 4.5 (Non-reasoning)33.37
13Qwen 3 14B (Non-reasoning)33.33
14GPT-5.4 Mini (Medium)33.3
15Gemma 3 12B (IT)33.26

Interactive version: theaggregate.ai/benchmark?slug=euroeval-hungarian-summarization-hunsum · How the rankings work · Data refreshed daily, snapshot 2026-07-22.