O1 Preview (2024-09-12) — benchmark results

September 12, 2024 O1 Preview snapshot, tracked when sources report the dated API model. Provider: OpenAI. Released 2024-09-12. Access: API.

Unified ELO 1666 ± 50, rank #331 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ZebraLogic71.4Puzzle Accuracy (%)91.8
Wolfram LLM Benchmarking Project52.2Correct Functionality (%)75.8
Vals AI MedQA93.01Accuracy (%)73.4
MATH Level 581.65Accuracy (%)65.7
CRUST-bench15Pass@1 Test Success (%)64.3
BIRD-CRITIC33.33Score60
OTIS Mock AIME 2024-2531.11Accuracy (%)34.9
WritingBench63.44Score (self-reported)30.8
SpeechMap Compliance35.8% Requests Completed12.4

Interactive version: theaggregate.ai/model?slug=o1-preview-2024-09-12 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.