GPT-5.2 (Medium): benchmark results

GPT-5.2 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1672 ± 1, rank #171 of 1761 rated models, from 168 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Elimination Game (Lechmazur)7.52TrueSkill μ100
Epoch AI - Algotune2.05Score100
Medmarks - MTSamples Procedures88.74Score (%)100
Medmarks - MTSamples Replicate98.06Score (%)100
Medmarks - MedCaseReasoning52.6Score (%)100
Medmarks - MedExQA86.93Score (%)100
Medmarks - MedR-Bench 1-Turn84.17Score (%)100
Medmarks - MedR-Bench Free-Turn89.08Score (%)100
Medmarks - MedR-Bench Oracle80.01Score (%)100
Medmarks - MetaMedQA82.88Score (%)100
Medmarks - PubHealthBench Freeform48.09Score (%)100
Medmarks - MedCalc-Bench81.36Score (%)98.6

Interactive version: theaggregate.ai/model?slug=gpt-5-2-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.