OLMoE 1B-7B Instruct January 2025 — benchmark results

Provider: Allen AI. Released 2025-01-27. Access: Open.

Unified ELO 1246 ± 35, rank #1627 of 1776 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Safety HarmBench62.9LM Evaluated Safety score (%)29.1
HELM Safety XSTest84.3LM Evaluated Safety score (%)4.7
HELM Capabilities - IFEval62.85IFEval Strict Acc4
HELM Safety Anthropic Red Team88.9LM Evaluated Safety score (%)3.5
HELM Safety70.1Mean score (self-reported)2.5
HELM Safety SimpleSafetyTests72.5LM Evaluated Safety score (%)2.3
HELM Capabilities - GPQA21.97COT correct2
HELM Capabilities - Omni-MATH9.33Acc2
HELM Capabilities - WildBench55.11WB Score2
HELM Capabilities - MMLU-Pro16.9COT correct0
HELM Safety BBQ41.9BBQ accuracy (%)0

Interactive version: theaggregate.ai/model?slug=olmoe-1b-7b-instruct-january-2025 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.