EuroEval Portuguese Summarization - Publico — leaderboard

Metric: Score (%). Source: euroeval.com. 150 models tracked.

Top models

#ModelScore
1Apertus-70B-Instruct-250934.74
2Qwen 3 30B A3B 2507 Instruct34.58
3Qwen 2.5 72B Instruct34.58
4GPT-5.234.41
5GPT-4.134.38
6Ministral-3-8B-Instruct-251233.81
7Claude Sonnet 4.5 (Thinking)33.74
8Gemini 3 Flash (Preview) (Non-reasoning)33.57
9Ministral-3-14B-Instruct-251233.56
10Claude Sonnet 4.633.44
11Claude Haiku 4.5 (20251001)33.44
12Claude Sonnet 4.5 (Non-reasoning)33.4
13GPT-5 Mini33.37
14Ministral-3-3B-Reasoning-251233.35
15Qwen 3 8B (Non-reasoning)33.26

Interactive version: theaggregate.ai/benchmark?slug=euroeval-portuguese-summarization-publico · How the rankings work · Data refreshed daily, snapshot 2026-07-22.