OLMo 3 7B Instruct: benchmark results
Allen AI OLMo 3 7B instruction-tuned checkpoint. Provider: Allen AI. Released 2025-11-20. Access: Open.
Unified ELO 1410 ± 1, rank #1095 of 1392 rated models, from 367 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| CringeBench | 0.69 | Cringe Score (0-10, lower is better) | 87.9 |
| EuroEval Portuguese NLU - ScaLA PT | 27.42 | Linguistic acceptability Score (%) | 82.5 |
| MERA Code - CodeCorrectness | 81.56 | Accuracy (%) | 80 |
| EuroEval English NLU - ScaLA EN | 52.13 | Linguistic acceptability Score (%) | 78.4 |
| EuroEval Italian NLU - ScaLA IT | 29.13 | Linguistic acceptability Score (%) | 76 |
| EuroEval Polish Summarization - PSC | 22.96 | Score (%) | 70.7 |
| EuroEval Dutch Summarization - Wiki Lingua NL | 33.57 | Score (%) | 70 |
| MERA - LCS | 16 | Accuracy (%) | 64.6 |
| EuroEval Catalan Summarization - Dacsa CA | 34.5 | Score (%) | 63.6 |
| EuroEval French NLU - ScaLA FR | 37.65 | Linguistic acceptability Score (%) | 61.7 |
| EuroEval Spanish NLU - ScaLA ES | 21.12 | Linguistic acceptability Score (%) | 59.9 |
| Medmarks - MedHallu Hard | 45.94 | Score (%) | 58.6 |
Interactive version: theaggregate.ai/model?slug=olmo-3-7b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.