OLMo-2-1124-7B-Instruct: benchmark results
Allen AI's instruct variant of the fully open OLMo 2 7B, post-trained with a Tulu 3-style recipe of SFT, DPO, and RLVR. Provider: Allen AI. Released 2024-11-24. Access: Open.
Unified ELO 1428 ± 1, rank #1037 of 1392 rated models, from 127 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 72.44 | Score | 86.3 |
| EuroEval Portuguese NLU - MultiWikiQA PT | 73.65 | Reading comprehension Score (%) | 77.1 |
| EuroEval German NLU - Germanquad | 57.65 | Reading comprehension Score (%) | 75.5 |
| Enkrypt AI - Jailbreak Risk | 5 | Risk Score | 75.4 |
| EuroEval English NLU - SQuAD | 82.43 | Reading comprehension Score (%) | 68.4 |
| EuroEval Finnish NLU - Tydiqa FI | 64.4 | Reading comprehension Score (%) | 64.1 |
| HREF | 28.49 | Average HREF Score (%) | 63.6 |
| EuroEval English NLU - SST-5 | 66.47 | Sentiment classification Score (%) | 63.5 |
| Enkrypt AI - Toxicity Risk | 2.18 | Risk Score | 63.2 |
| LA Leaderboard - GalCoLA | 51.96 | Accuracy (%) | 63.2 |
| Enkrypt AI - Safety Risk | 23.65 | Risk Score | 62.4 |
| Open LLM Leaderboard - MATH Level 5 | 14.88 | Score | 61.8 |
Interactive version: theaggregate.ai/model?slug=olmo-2-1124-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.