GPT-5.2: benchmark results

OpenAI's standard GPT-5.2 model for general-purpose reasoning, coding, and writing. Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1681 ± 1, rank #82 of 1392 rated models, from 969 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ALL Bench Multimodal86.7Average Numeric VLM Score (%)100
AMA-Bench69.83Average Score (%)100
AMA-Bench - Game81.13Average Score (%)100
CLEM ImageGame99.92Game Clemscore (%)100
CringeBench0.29Cringe Score (0-10, lower is better)100
DramaBench96.04Overall Score (%)100
EHRBench70.91Overall Acc (%) (self-reported)100
EsoLang-Bench4.2Accuracy (%)100
Factory Code Review Benchmark60.5Mean F1 (%)100
From Perception to Action22.9pass@1 (self-reported)100
GDPval-MM70.9Wins + ties (self-reported)100
GPQA Diamond (Opus 4.6 System Card)93.2Accuracy (%)100

Interactive version: theaggregate.ai/model?slug=gpt-5-2 · How It Works · Data refreshed daily, snapshot 2026-09-05.