EuroEval Portuguese Summarization - Publico: leaderboard

Metric: Score (%). Source: euroeval.com. 150 models tracked.

Top models

#ModelScore
1Apertus-70B-Instruct-250934.74
2Qwen 3 30B A3B 2507 Instruct34.58
3Qwen 2.5 72B Instruct34.58
4GPT-5.234.41
5GPT-4.134.38
6Ministral-3-8B-Instruct-251233.81
7Claude Sonnet 4.5 (Thinking)33.74
8Ministral-3-14B-Instruct-251233.56
9Claude Sonnet 4.633.44
10Claude Haiku 4.5 (20251001)33.44
11Claude Sonnet 4.5 (Non-reasoning)33.4
12GPT-5 Mini33.37
13Ministral-3-3B-Reasoning-251233.35
14Gemini 3.1 Flash Lite (Preview)33.18
15GPT-5.4 Nano (High)33.09

Interactive version: theaggregate.ai/benchmark?slug=euroeval-portuguese-summarization-publico · How It Works · Data refreshed daily, snapshot 2026-09-05.