O1 Mini — benchmark results

OpenAI's smaller o1-series reasoning model for cost-efficient STEM tasks. Provider: OpenAI. Released 2024-09-12. Access: API.

Unified ELO 1649 ± 18, rank #370 of 1776 rated models, from 97 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AgentIF59.8Constraint Success Rate (self-reported)100
Carlini Applied LLM Benchmark62Pass Rate (%)100
Omni-MATH60.54Overall Accuracy (%)100
ProLLM - Q&A Assistant98.9Score (%)100
SEAL - Coding1237Score100
PRMBench68.8Overall Score98
HumanEval+89HumanEval+ pass@1 (self-reported)97.8
Ru Arena Hard93.45Win Rate (%)97.8
CodeElo1578Elo Rating97.1
FullStackBench en64.73Score (self-reported)96.3
LLM2014 Logic 2024-0976.81Score (%)96.3
LLM2014 Logic 2024-1074.89Score (%)96.3

Interactive version: theaggregate.ai/model?slug=o1-mini · How the rankings work · Data refreshed daily, snapshot 2026-07-22.