Olmo-3.1-32B-Instruct-SFT: benchmark results
Provider: Allen AI. Released 2025-12-23. Access: Open.
Unified ELO 1447 ± 1, rank #1117 of 1761 rated models, from 295 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Bosnian NLU - Multi Wiki QA BS | 75.21 | Reading comprehension Score (%) | 97.6 |
| EuroEval Croatian NLU - Multi Wiki QA HR | 70.12 | Reading comprehension Score (%) | 97.6 |
| EuroEval Romanian NLU - MultiWikiQA RO | 75.08 | Reading comprehension Score (%) | 94.7 |
| EuroEval Danish NLU - Multi Wiki QA DA | 80.11 | Reading comprehension Score (%) | 93.3 |
| EuroEval English NLU - ScaLA EN | 62.8 | Linguistic acceptability Score (%) | 93.1 |
| EuroEval Catalan NLU - MultiWikiQA CA | 75.28 | Reading comprehension Score (%) | 91.9 |
| EuroEval Swedish NLU - Multi Wiki QA SV | 78.34 | Reading comprehension Score (%) | 91.7 |
| EuroEval Polish NLU - PoQuAD | 59.18 | Reading comprehension Score (%) | 90.6 |
| EuroEval Portuguese NLU | 61.21 | NLU Average Score (%) | 90.5 |
| EuroEval French NLU | 69.82 | NLU Average Score (%) | 89.6 |
| EuroEval German NLU - Germanquad | 64.92 | Reading comprehension Score (%) | 89.4 |
| EuroEval Ukrainian NLU - Cross Domain UK Reviews | 61.48 | Sentiment classification Score (%) | 88.8 |
Interactive version: theaggregate.ai/model?slug=olmo-3-1-32b-instruct-sft · How It Works · Data refreshed daily, snapshot 2026-09-05.