GPT-5.2 (Medium): benchmark results
GPT-5.2 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2025-12-11. Access: API.
Unified ELO 1672 ± 1, rank #171 of 1761 rated models, from 168 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Elimination Game (Lechmazur) | 7.52 | TrueSkill μ | 100 |
| Epoch AI - Algotune | 2.05 | Score | 100 |
| Medmarks - MTSamples Procedures | 88.74 | Score (%) | 100 |
| Medmarks - MTSamples Replicate | 98.06 | Score (%) | 100 |
| Medmarks - MedCaseReasoning | 52.6 | Score (%) | 100 |
| Medmarks - MedExQA | 86.93 | Score (%) | 100 |
| Medmarks - MedR-Bench 1-Turn | 84.17 | Score (%) | 100 |
| Medmarks - MedR-Bench Free-Turn | 89.08 | Score (%) | 100 |
| Medmarks - MedR-Bench Oracle | 80.01 | Score (%) | 100 |
| Medmarks - MetaMedQA | 82.88 | Score (%) | 100 |
| Medmarks - PubHealthBench Freeform | 48.09 | Score (%) | 100 |
| Medmarks - MedCalc-Bench | 81.36 | Score (%) | 98.6 |
Interactive version: theaggregate.ai/model?slug=gpt-5-2-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.