OLMo-2-1124-7B: benchmark results

Provider: Allen AI. Released 2024-11-26. Access: Open.

Unified ELO 1341 ± 23, rank #1386 of 1632 rated models, from 198 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval French NLU - FQuAD76.56Reading comprehension Score (%)98.7
EuroEval English NLU - SQuAD87.82Reading comprehension Score (%)95.7
EuroEval Spanish NLU - MLQA ES69.06Reading comprehension Score (%)95.4
LA Leaderboard - XL-Sum Spanish3.59BLEU94
LA Leaderboard - MGSM Spanish10Exact Match (%)93.8
LA Leaderboard - CatalanQA82.12F1 (%)92.3
LA Leaderboard - XQuAD Catalan73.66F1 (%)92.3
LA Leaderboard - XQuAD Spanish76.04F1 (%)92.3
EuroEval German NLU - Germanquad66.81Reading comprehension Score (%)91.9
EuroEval English NLU - SST-569.18Sentiment classification Score (%)91.6
LA Leaderboard - WNLI Spanish69.01Accuracy (%)89.7
LA Leaderboard - MGSM Galician8.8Exact Match (%)88.5

Interactive version: theaggregate.ai/model?slug=olmo-2-1124-7b · How It Works · Data refreshed daily, snapshot 2026-10-08.