O1 Mini: benchmark results

OpenAI's smaller o1-series reasoning model for cost-efficient STEM tasks. Provider: OpenAI. Released 2024-09-12. Access: API.

Unified ELO 1560 ± 1, rank #402 of 1392 rated models, from 107 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AgentIF59.8Constraint Success Rate (self-reported)100
Carlini Applied LLM Benchmark62Pass Rate (%)100
Omni-MATH60.54Overall Accuracy (%)100
ProLLM - Q&A Assistant98.9Score (%)100
SEAL - Coding1237Score100
PRMBench68.8Overall Score98
Ru Arena Hard93.45Win Rate (%)97.8
CodeElo1578Elo Rating97.1
FullStackBench en64.73Score (self-reported)96.7
μ-MATH84.8Accuracy (%)94.1
U-MATH - Algebra87.78Accuracy (%)93.9
U-MATH - Differential Calculus68.18Accuracy (%)93.9

Interactive version: theaggregate.ai/model?slug=o1-mini · How It Works · Data refreshed daily, snapshot 2026-09-05.