O1 Mini — benchmark results
OpenAI's smaller o1-series reasoning model for cost-efficient STEM tasks. Provider: OpenAI. Released 2024-09-12. Access: API.
Unified ELO 1649 ± 18, rank #370 of 1776 rated models, from 97 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AgentIF | 59.8 | Constraint Success Rate (self-reported) | 100 |
| Carlini Applied LLM Benchmark | 62 | Pass Rate (%) | 100 |
| Omni-MATH | 60.54 | Overall Accuracy (%) | 100 |
| ProLLM - Q&A Assistant | 98.9 | Score (%) | 100 |
| SEAL - Coding | 1237 | Score | 100 |
| PRMBench | 68.8 | Overall Score | 98 |
| HumanEval+ | 89 | HumanEval+ pass@1 (self-reported) | 97.8 |
| Ru Arena Hard | 93.45 | Win Rate (%) | 97.8 |
| CodeElo | 1578 | Elo Rating | 97.1 |
| FullStackBench en | 64.73 | Score (self-reported) | 96.3 |
| LLM2014 Logic 2024-09 | 76.81 | Score (%) | 96.3 |
| LLM2014 Logic 2024-10 | 74.89 | Score (%) | 96.3 |
Interactive version: theaggregate.ai/model?slug=o1-mini · How the rankings work · Data refreshed daily, snapshot 2026-07-22.