EuroLLM-9B: benchmark results

Provider: EuroLLM. Released 2025-02-01. Access: Open.

Unified ELO 1394 ± 15, rank #1224 of 1632 rated models, from 413 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LA Leaderboard - CatalanQA84.2F1 (%)100
LA Leaderboard - caBREU Catalan19.55BLEU100
EuroEval Finnish NLU - Tydiqa FI77.33Reading comprehension Score (%)99.2
LA Leaderboard - OpenBookQA Galician33.4Accuracy (%)98.5
LA Leaderboard - xStoryCloze Galician70.75Accuracy (%)97.1
LA Leaderboard - XL-Sum Spanish3.77BLEU97
LA Leaderboard - CoQCat76.1F1 (%)96.9
LA Leaderboard - XQuAD Catalan75.09F1 (%)96.9
EuroEval Dutch Simplification - Duidelijke Taal56.49Score (%)96.6
LA Leaderboard - OpenBookQA Spanish37.8Accuracy (%)95.6
LA Leaderboard - TE-ca52.24Accuracy (%)95.6
EuroEval Czech NLU - CSFD Sentiment64.86Sentiment classification Score (%)94.3

Interactive version: theaggregate.ai/model?slug=eurollm-9b · How It Works · Data refreshed daily, snapshot 2026-10-08.