GPT-5.2 (2025-12-11) (xHigh): benchmark results

Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1778 ± 13, rank #179 of 2131 rated models, from 148 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Context-Bench Skills85.31Task Completion (%)100
Nejumi 4 - Toxicity - Social Norms99.6Criteria met (%)98.6
Nejumi 4 - jaster (2-shot) - MGSM95Exact match (%)98.6
Nejumi 4 - jaster (0-shot) - MMLU-ProX (Japanese)91Exact match (%)97.9
Nejumi 4 - Toxicity - Prohibited Acts98.44Criteria met (%)96.5
Horangi 4 - Ko-AIME 2025100Accuracy (%)96.2
Horangi 4 - Ko-ARC-AGI92.71Accuracy (%)95.2
Chess Puzzles (Epoch AI)49Accuracy (%)94.9
Horangi 4 - HAE-RAE Bench (without Reading Comprehension)98.99Accuracy (%)94.7
Horangi 4 - GLP - Mathematical Reasoning97Score (%)94.2
Horangi 4 - GLP - General Knowledge94.49Score (%)93.8
Horangi 4 - HAE-RAE Bench (Reading Comprehension)92Accuracy (%)93.8

Interactive version: theaggregate.ai/model?slug=gpt-5-2-2025-12-11-xhigh · How It Works · Data refreshed daily, snapshot 2026-10-09.