Olmo-3.1-32B-Instruct-DPO: benchmark results

Provider: Allen AI. Released 2025-12-23. Access: Open.

Unified ELO 1462 ± 1, rank #1045 of 1761 rated models, from 295 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Catalan NLU - MultiWikiQA CA75.98Reading comprehension Score (%)93.8
EuroEval Dutch Summarization - Wiki Lingua NL35.07Score (%)92
EuroEval Danish NLU - Multi Wiki QA DA79.52Reading comprehension Score (%)91.8
EuroEval Romanian NLU - MultiWikiQA RO73.9Reading comprehension Score (%)91.7
EuroEval English NLU - ScaLA EN61.04Linguistic acceptability Score (%)91.1
EuroEval Swedish NLU - Multi Wiki QA SV78.05Reading comprehension Score (%)90.5
EuroEval Portuguese NLU - ScaLA PT40.23Linguistic acceptability Score (%)89.8
EuroEval Portuguese NLU60.24NLU Average Score (%)88.9
EuroEval Ukrainian NLU - Cross Domain UK Reviews61.48Sentiment classification Score (%)88.8
EuroEval French NLU - ScaLA FR53.13Linguistic acceptability Score (%)88.6
EuroEval Italian NLU - ScaLA IT43.24Linguistic acceptability Score (%)88.5
EuroEval French NLU - Allocine95.22Sentiment classification Score (%)88.4

Interactive version: theaggregate.ai/model?slug=olmo-3-1-32b-instruct-dpo · How It Works · Data refreshed daily, snapshot 2026-09-05.