OLMoE 1B-7B Instruct January 2025: benchmark results

Provider: Allen AI. Released 2025-01-27. Access: Open.

Unified ELO 1324 ± 1, rank #1314 of 1392 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Safety HarmBench62.9LM Evaluated Safety score (%)29.1
HELM Safety XSTest84.3LM Evaluated Safety score (%)4.7
HELM Capabilities - IFEval62.85IFEval Strict Acc4
HELM Safety Anthropic Red Team88.9LM Evaluated Safety score (%)3.5
HELM Safety70.1Mean score (self-reported)3
HELM Safety SimpleSafetyTests72.5LM Evaluated Safety score (%)2.3
HELM Capabilities - GPQA21.97COT correct2
HELM Capabilities - Omni-MATH9.33Acc2
HELM Capabilities - WildBench55.11WB Score2
HELM Capabilities - MMLU-Pro16.9COT correct0
HELM Safety BBQ41.9BBQ accuracy (%)0

Interactive version: theaggregate.ai/model?slug=olmoe-1b-7b-instruct-january-2025 · How It Works · Data refreshed daily, snapshot 2026-09-05.