GPT-5.2 (Medium) — benchmark results
GPT-5.2 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2025-12-11. Access: API.
Unified ELO 1899 ± 20, rank #66 of 1776 rated models, from 183 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Elimination Game (Lechmazur) | 7.52 | TrueSkill μ | 100 |
| Epoch AI - Algotune | 2.05 | Score | 100 |
| Medmarks - MTSamples Procedures | 88.74 | Score (%) | 100 |
| Medmarks - MTSamples Replicate | 98.06 | Score (%) | 100 |
| Medmarks - MedCaseReasoning | 52.6 | Score (%) | 100 |
| Medmarks - MedExQA | 86.93 | Score (%) | 100 |
| Medmarks - MedR-Bench 1-Turn | 84.17 | Score (%) | 100 |
| Medmarks - MedR-Bench Free-Turn | 89.08 | Score (%) | 100 |
| Medmarks - MedR-Bench Oracle | 80.01 | Score (%) | 100 |
| Medmarks - MetaMedQA | 82.88 | Score (%) | 100 |
| Medmarks - PubHealthBench Freeform | 48.09 | Score (%) | 100 |
| AA LiveCodeBench | 89.42 | Pass@1 (%) | 99 |
Interactive version: theaggregate.ai/model?slug=gpt-5-2-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.