EuroEval Romanian Summarization - Sumo RO: leaderboard

Metric: Score (%). Source: euroeval.com. 150 models tracked.

Top models

#ModelScore
1GPT-4.138.27
2Gemini 3 Pro (Preview)37.55
3Apertus-70B-Instruct-250937.51
4Mistral Small 3.137.27
5Qwen 3 30B A3B 2507 Instruct37.22
6GPT-5.4 Mini (High)37.14
7GPT-5.4 Mini (Medium)37
8Qwen 2.5 72B Instruct36.99
9Mistral Small 3.236.94
10Llama 3.3 70B Instruct36.76
11Gemma 4 31B (IT)36.75
12Claude Sonnet 4.5 (Non-reasoning)36.74
13Gemma 3n E4B (IT)36.66
14Gemma 4 26B A4B (IT)36.6
15Ministral-3-14B-Instruct-251236.57

Interactive version: theaggregate.ai/benchmark?slug=euroeval-romanian-summarization-sumo-ro · How It Works · Data refreshed daily, snapshot 2026-09-05.