OLMo-2-1124-7B — benchmark results

Provider: Allen AI. Released 2024-11-24. Access: Open.

Unified ELO 1386 ± 14, rank #1280 of 1776 rated models, from 112 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval French NLU - FQuAD76.56Reading comprehension Score (%)98.7
EuroEval English NLU - SQuAD87.82Reading comprehension Score (%)95.7
EuroEval Spanish NLU - MLQA ES69.06Reading comprehension Score (%)95.4
EuroEval German NLU - Germanquad66.81Reading comprehension Score (%)91.9
EuroEval English NLU - SST-569.18Sentiment classification Score (%)91.6
EuroEval Dutch NLU - SQuAD NL77.19Reading comprehension Score (%)81.9
EuroEval Portuguese NLU - MultiWikiQA PT74.45Reading comprehension Score (%)81.8
EuroEval Finnish NLU - Tydiqa FI68.53Reading comprehension Score (%)80.2
EuroEval Swedish NLU - Swerec77.67Sentiment classification Score (%)78.4
EuroEval Icelandic NLU - NQII50.99Reading comprehension Score (%)71.8
LA Leaderboard - GalCoLA52.9Accuracy (%)69.1
EuroEval Italian NLU - SQuAD IT69.27Reading comprehension Score (%)64.6

Interactive version: theaggregate.ai/model?slug=olmo-2-1124-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.