GPT-5.5 Pro (xHigh): benchmark results
GPT-5.5 Pro evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.
Unified ELO 1770 ± 1, rank #19 of 1761 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Chess Puzzles (Epoch AI) | 64 | Accuracy (%) | 99.3 |
| AA CritPt | 30.57 | Accuracy (%) | 99.2 |
| OTIS Mock AIME 2024-25 | 100 | Accuracy (%) | 99 |
| Epoch AI - Critpt | 30.57 | Score | 98.8 |
| FrontierMath - Tiers 1-3 | 51 | Accuracy (%, 290 problems) | 98 |
| FrontierMath - Tier 4 | 39.6 | Accuracy (%, 48 problems) | 97.9 |
| FrontierMath - Tiers 1-3 (v2) | 87.72 | Accuracy (%, 285 private v2 problems) | 97.6 |
| Epoch AI - Dtbench | 96 | Score | 96.2 |
| Conceptual Reasoning Index - Argument Evaluation (LMCA) | 53.94 | Chance-Corrected Score (0-100) | 95.9 |
| IMO-Bench | 88.1 | Advanced ProofBench Accuracy (%) | 90.9 |
| ARC-AGI-2 | 84.16 | Accuracy (%) | 90.5 |
| ARC-AGI-1 | 95 | Accuracy (%) | 90.2 |
Interactive version: theaggregate.ai/model?slug=gpt-5-5-pro-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.