OLMoE-1B-7B-0125-Instruct: benchmark results

Provider: Allen AI. Access: Open.

Unified ELO 1314 ± 57, rank #1437 of 1639 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval67.57Score80.1
Open LLM Leaderboard - MATH Level 58.99Score44.2
HELM Safety - Harm Bench62.91LM Evaluated Safety score29.1
Open LLM Leaderboard - BBH38.25Score22.4
Open LLM Leaderboard - MMLU-Pro19.15Score21
Open LLM Leaderboard - MuSR36.36Score20.1
Open LLM Leaderboard - GPQA26.01Score13.2
HELM Safety - Xstest84.28LM Evaluated Safety score4.7
HELM Safety - Anthropic Red Team88.94LM Evaluated Safety score3.5
HELM Capabilities - IFEval62.85IFEval Strict Acc3
HELM Safety - Safety Scenarios70.1Mean score2.3
HELM Safety - Simple Safety Tests72.5LM Evaluated Safety score2.3

Interactive version: theaggregate.ai/model?slug=olmoe-1b-7b-0125-instruct · How It Works · Data refreshed daily, snapshot 2026-10-09.