O1 Preview — benchmark results
OpenAI's September 2024 preview release of the o1 reasoning model. Provider: OpenAI. Released 2024-09-12. Access: API.
Unified ELO 1709 ± 22, rank #260 of 1776 rated models, from 77 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Divergent Thinking | 4.79 | Divergence Score | 100 |
| EvalPlus | 84.6 | EvalPlus Avg. (self-reported) | 100 |
| FullStackBench en | 65.62 | Score (self-reported) | 100 |
| LLM2014 Logic 2024-09 | 87.52 | Score (%) | 100 |
| LLM2014 Logic 2024-10 | 86.55 | Score (%) | 100 |
| MBPP+ | 80.2 | MBPP+ pass@1 (self-reported) | 100 |
| MixEval | 72 | Score | 100 |
| Multi-IF | 87.7 | Average (self-reported) | 100 |
| SEAL - Japanese | 1118 | Score | 100 |
| SEAL - Korean | 66.43 | Score | 100 |
| WebApp1K-React | 0.95 | pass@1 | 100 |
| HumanEval+ | 89 | HumanEval+ pass@1 (self-reported) | 97.8 |
Interactive version: theaggregate.ai/model?slug=o1-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.