O1 Mini: benchmark results
OpenAI's smaller o1-series reasoning model for cost-efficient STEM tasks. Provider: OpenAI. Released 2024-09-12. Access: API.
Unified ELO 1560 ± 1, rank #402 of 1392 rated models, from 107 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AgentIF | 59.8 | Constraint Success Rate (self-reported) | 100 |
| Carlini Applied LLM Benchmark | 62 | Pass Rate (%) | 100 |
| Omni-MATH | 60.54 | Overall Accuracy (%) | 100 |
| ProLLM - Q&A Assistant | 98.9 | Score (%) | 100 |
| SEAL - Coding | 1237 | Score | 100 |
| PRMBench | 68.8 | Overall Score | 98 |
| Ru Arena Hard | 93.45 | Win Rate (%) | 97.8 |
| CodeElo | 1578 | Elo Rating | 97.1 |
| FullStackBench en | 64.73 | Score (self-reported) | 96.7 |
| μ-MATH | 84.8 | Accuracy (%) | 94.1 |
| U-MATH - Algebra | 87.78 | Accuracy (%) | 93.9 |
| U-MATH - Differential Calculus | 68.18 | Accuracy (%) | 93.9 |
Interactive version: theaggregate.ai/model?slug=o1-mini · How It Works · Data refreshed daily, snapshot 2026-09-05.