GPT-5.2 — benchmark results

OpenAI's standard GPT-5.2 model for general-purpose reasoning, coding, and writing. Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1738 ± 8, rank #213 of 1776 rated models, from 864 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ALL Bench Multimodal86.7Average Numeric VLM Score (%)100
AMA-Bench69.83Average Score (%)100
AMA-Bench - Game81.13Average Score (%)100
CLEM ImageGame99.92Game Clemscore (%)100
DramaBench96.04Overall Score (%)100
EHRBench70.91Overall Acc (%) (self-reported)100
EsoLang-Bench4.2Accuracy (%)100
Factory Code Review Benchmark60.5Mean F1 (%)100
From Perception to Action22.9pass@1 (self-reported)100
GDPval-MM70.9Wins + ties (self-reported)100
GPQA Diamond (Opus 4.6 System Card)93.2Accuracy (%)100
Kernel Arena - KernelBench HIP9.15Mean Correctness+Speedup100

Interactive version: theaggregate.ai/model?slug=gpt-5-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.