EuroEval Albanian Summarization - LR SUM SQ: leaderboard

Metric: Score (%). Source: euroeval.com. 154 models tracked.

Top models

#ModelScore
1Tiny Aya Global35.09
2Mistral Small 3.134.73
3Llama 3.1 8B Instruct34.7
4Claude Sonnet 4.5 (Non-reasoning)34.68
5gemma-4-E2B-it33.87
6Apertus-70B-Instruct-250933.87
7GPT-4.133.78
8Gemma 4 31B (IT)33.78
9gemma-4-E4B-it33.75
10Qwen 2.5 72B Instruct33.63
11Mistral Small 3.233.61
12Qwen 3.5 2B33.48
13Grok 4.20 Beta (0309) (Reasoning)33.48
14Gemma 4 26B A4B (IT)33.26
15Ministral-3-8B-Instruct-251233.01

Interactive version: theaggregate.ai/benchmark?slug=euroeval-albanian-summarization-lr-sum-sq · How It Works · Data refreshed daily, snapshot 2026-09-05.