GPT-5.2 Chat: benchmark results

Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1609 ± 1, rank #392 of 1761 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LM Market Cap LMC Score90.5LMC Score (0-100)94.5
Conceptual Reasoning Index - Argument Evaluation (LMCA)40.12Chance-Corrected Score (0-100)78.5
BenchTable61.7Total Score (%)74.1
SnakeBench25.6TrueSkill Rating68.9
Conceptual Reasoning Index51.04Chance-Corrected Score (0-100)66.4
Conceptual Reasoning Index - Decision Theory (DTBench)68.88Chance-Corrected Score (0-100)66.2
Conceptual Reasoning Index - Consistency (ACCoRD)65.97Chance-Corrected Score (0-100)64.9
OpenRouter GPQA Diamond79.8Accuracy (%)48.4
OpenRouter Tau2-Bench Airline67.3Accuracy (%)40.8

Interactive version: theaggregate.ai/model?slug=gpt-5-2-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.