O1 (Medium) — benchmark results

O1 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2024-12-05. Access: API.

Unified ELO 1688 ± 34, rank #298 of 1776 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AI for Education Pedagogy - Social studies90Accuracy (%)97.5
Gapminder AI Worldview90.9Correct Rate (%)94.1
AI for Education Pedagogy - Science90.71Accuracy (%)85
AI for Education Pedagogy - Secondary86.64Accuracy (%)83.4
MATH Level 594.41Accuracy (%)83.3
AI for Education Pedagogy86.43Accuracy (%)78.6
AI for Education Pedagogy - Technology83.02Accuracy (%)77.5
PlatinumBench (MIT)1.27Avg Error Rate (%)75.8
LLM Chess (Saplin)280.1ELO75
AI for Education SEND79.36Accuracy (%)73.6
AI for Education Pedagogy - Primary87.32Accuracy (%)69.1
IneqMath8Overall Accuracy (self-reported)62.2

Interactive version: theaggregate.ai/model?slug=o1-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.