GPT-5.2 (2025-12-11) (High): benchmark results

Provider: OpenAI. Released 2025-12-11. Access: API.

Unified ELO 1743 ± 15, rank #249 of 2131 rated models, from 67 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenCompass Reasoning - Academic (CompassBench 2601)50.5Score (%)100
OpenCompass Math - Competition (CompassBench 2601)70Score (%)98
OpenCompass LLM - Reasoning (CompassBench 2601)60.1Score (%)96
OpenCompass Reasoning - Common (CompassBench 2601)69.6Score (%)96
Context-Bench Skills84.47Task Completion (%)95.2
EsoBench26.87Score94.6
OpenCompass Code - Competition (CompassBench 2601)62.9Score (%)92
OpenCompass Knowledge - Science (CompassBench 2601)97Score (%)92
OpenCompass LLM - Code (CompassBench 2601)71.2Score (%)92
OpenCompass Code - Comprehensive (CompassBench 2601)79.5Score (%)90
OTIS Mock AIME 2024-2596.11Accuracy (%)88.7
Chess Puzzles (Epoch AI)40Accuracy (%)88.5

Interactive version: theaggregate.ai/model?slug=gpt-5-2-2025-12-11-high · How It Works · Data refreshed daily, snapshot 2026-10-09.