O1 Preview: benchmark results
OpenAI's September 2024 preview release of the o1 reasoning model. Provider: OpenAI. Released 2024-09-12. Access: API.
Unified ELO 1613 ± 1, rank #225 of 1392 rated models, from 94 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Divergent Thinking | 4.79 | Divergence Score | 100 |
| FullStackBench en | 65.62 | Score (self-reported) | 100 |
| MixEval | 72 | Score | 100 |
| SEAL - Japanese | 1118 | Score | 100 |
| SEAL - Korean | 66.43 | Score | 100 |
| WebApp1K-React | 0.95 | pass@1 | 100 |
| Enkrypt AI - Jailbreak Risk | 0.86 | Risk Score | 98.1 |
| ChemBench | 64 | Overall Score (%) | 97.3 |
| WebApp1K | 95.2 | Pass@1 (%) | 97 |
| Multi-IF | 87.7 | Average (self-reported) | 96.4 |
| Ru Arena Hard | 90.8 | Win Rate (%) | 94.1 |
| Klu LLM Leaderboard | 99 | Klu Index | 93.8 |
Interactive version: theaggregate.ai/model?slug=o1-preview · How It Works · Data refreshed daily, snapshot 2026-09-05.