GPT-5.2 (High) — benchmark results

GPT-5.2 evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1978 ± 25, rank #33 of 1776 rated models, from 113 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CLEM AdventureGame99.17Game Clemscore (%)100
CLEM Clean Up100Game Clemscore (%)100
CLEM Codenames87.69Game Clemscore (%)100
CLEM Deal or No Deal99.12Game Clemscore (%)100
CLEM GuessWhat93.33Game Clemscore (%)100
GDPval (OpenAI Evals)49.88Win Rate (%)100
LLM2014 Logic 2025-1281.83Median Score100
LLM2014 Logic 2026-0180.71Median Score100
MCPMark57.48Pass@1 (%)100
Pencil Puzzle Bench - Yajilin20Direct-ask Success Rate (%)100
TriggerBench90.88Slot Match (Positive Clean) (self-reported)100
Pencil Puzzle Bench - Slitherlink33.3Direct-ask Success Rate (%)99

Interactive version: theaggregate.ai/model?slug=gpt-5-2-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.