Olmo-3.1-32B-Instruct-DPO: benchmark results
Provider: Allen AI. Released 2025-12-23. Access: Open.
Unified ELO 1462 ± 1, rank #1045 of 1761 rated models, from 295 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Catalan NLU - MultiWikiQA CA | 75.98 | Reading comprehension Score (%) | 93.8 |
| EuroEval Dutch Summarization - Wiki Lingua NL | 35.07 | Score (%) | 92 |
| EuroEval Danish NLU - Multi Wiki QA DA | 79.52 | Reading comprehension Score (%) | 91.8 |
| EuroEval Romanian NLU - MultiWikiQA RO | 73.9 | Reading comprehension Score (%) | 91.7 |
| EuroEval English NLU - ScaLA EN | 61.04 | Linguistic acceptability Score (%) | 91.1 |
| EuroEval Swedish NLU - Multi Wiki QA SV | 78.05 | Reading comprehension Score (%) | 90.5 |
| EuroEval Portuguese NLU - ScaLA PT | 40.23 | Linguistic acceptability Score (%) | 89.8 |
| EuroEval Portuguese NLU | 60.24 | NLU Average Score (%) | 88.9 |
| EuroEval Ukrainian NLU - Cross Domain UK Reviews | 61.48 | Sentiment classification Score (%) | 88.8 |
| EuroEval French NLU - ScaLA FR | 53.13 | Linguistic acceptability Score (%) | 88.6 |
| EuroEval Italian NLU - ScaLA IT | 43.24 | Linguistic acceptability Score (%) | 88.5 |
| EuroEval French NLU - Allocine | 95.22 | Sentiment classification Score (%) | 88.4 |
Interactive version: theaggregate.ai/model?slug=olmo-3-1-32b-instruct-dpo · How It Works · Data refreshed daily, snapshot 2026-09-05.