O1 Preview: benchmark results

OpenAI's September 2024 preview release of the o1 reasoning model. Provider: OpenAI. Released 2024-09-12. Access: API.

Unified ELO 1613 ± 1, rank #225 of 1392 rated models, from 94 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Divergent Thinking4.79Divergence Score100
FullStackBench en65.62Score (self-reported)100
MixEval72Score100
SEAL - Japanese1118Score100
SEAL - Korean66.43Score100
WebApp1K-React0.95pass@1100
Enkrypt AI - Jailbreak Risk0.86Risk Score98.1
ChemBench64Overall Score (%)97.3
WebApp1K95.2Pass@1 (%)97
Multi-IF87.7Average (self-reported)96.4
Ru Arena Hard90.8Win Rate (%)94.1
Klu LLM Leaderboard99Klu Index93.8

Interactive version: theaggregate.ai/model?slug=o1-preview · How It Works · Data refreshed daily, snapshot 2026-09-05.