OLMo-2-1124-7B-Instruct — benchmark results
Allen AI's instruct variant of the fully open OLMo 2 7B, post-trained with a Tulu 3-style recipe of SFT, DPO, and RLVR. Provider: Allen AI. Released 2024-11-24. Access: Open.
Unified ELO 1414 ± 11, rank #1159 of 1776 rated models, from 121 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 72.44 | Score | 86.3 |
| EuroEval Portuguese NLU - MultiWikiQA PT | 73.65 | Reading comprehension Score (%) | 77.1 |
| EuroEval German NLU - Germanquad | 57.65 | Reading comprehension Score (%) | 75.5 |
| EuroEval English NLU - SQuAD | 82.43 | Reading comprehension Score (%) | 68.4 |
| EuroEval Finnish NLU - Tydiqa FI | 64.4 | Reading comprehension Score (%) | 64.1 |
| HREF | 28.49 | Average HREF Score (%) | 63.6 |
| EuroEval English NLU - SST-5 | 66.47 | Sentiment classification Score (%) | 63.5 |
| LA Leaderboard - GalCoLA | 51.96 | Accuracy (%) | 63.2 |
| Open LLM Leaderboard - MATH Level 5 | 14.88 | Score | 61.8 |
| EuroEval Swedish NLU - Swerec | 75.97 | Sentiment classification Score (%) | 59.8 |
| LA Leaderboard - AQuAS | 65.96 | Accuracy (%) | 57.4 |
| EuroEval Icelandic NLU - NQII | 47.63 | Reading comprehension Score (%) | 55.9 |
Interactive version: theaggregate.ai/model?slug=olmo-2-1124-7b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.