GPT-5.5 Pro (xHigh): benchmark results

GPT-5.5 Pro evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 1770 ± 1, rank #19 of 1761 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chess Puzzles (Epoch AI)64Accuracy (%)99.3
AA CritPt30.57Accuracy (%)99.2
OTIS Mock AIME 2024-25100Accuracy (%)99
Epoch AI - Critpt30.57Score98.8
FrontierMath - Tiers 1-351Accuracy (%, 290 problems)98
FrontierMath - Tier 439.6Accuracy (%, 48 problems)97.9
FrontierMath - Tiers 1-3 (v2)87.72Accuracy (%, 285 private v2 problems)97.6
Epoch AI - Dtbench96Score96.2
Conceptual Reasoning Index - Argument Evaluation (LMCA)53.94Chance-Corrected Score (0-100)95.9
IMO-Bench88.1Advanced ProofBench Accuracy (%)90.9
ARC-AGI-284.16Accuracy (%)90.5
ARC-AGI-195Accuracy (%)90.2

Interactive version: theaggregate.ai/model?slug=gpt-5-5-pro-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.