OLMo-7B-Instruct: benchmark results
Provider: Allen AI. Released 2024-02-23. Access: Open.
Unified ELO 1348 ± 1, rank #1274 of 1392 rated models, from 19 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| RewardBench | 67.27 | Score (%) | 46.6 |
| RewardBench Chat Hard | 50.66 | Accuracy (%) | 29.3 |
| BiGGen-Bench | 2.97 | Average Score (1-5) | 28.4 |
| RewardBench Chat | 89.66 | Accuracy (%) | 28.4 |
| RewardBench Reasoning | 71.68 | Accuracy (%) | 26.6 |
| RewardBench Prior Sets (0.5 weight) | 51.73 | Score (%) | 26 |
| RewardBench Safety | 64.86 | Accuracy (%) | 18.2 |
| BenchBench | 15.67 | Aggregate Score (%) | 14 |
| MixEval | 26.7 | Score | 5.9 |
| Chatbot Arena (Text - Multi-Turn) | 1042 | Arena Score | 3.8 |
| Chatbot Arena (Text - Math) | 1053 | Arena Score | 3.7 |
| Chatbot Arena (Text - English) | 1110 | Arena Score | 3.5 |
Interactive version: theaggregate.ai/model?slug=olmo-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.