GPT-5.5 Pro (xHigh) — benchmark results

GPT-5.5 Pro evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 2268 ± 57, rank #2 of 1776 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chess Puzzles (Epoch AI)64Accuracy (%)99.1
OTIS Mock AIME 2024-25100Accuracy (%)99
Epoch AI - Critpt30.57Score98.6
FrontierMath - Tiers 1-351Accuracy (%, 290 problems)98
FrontierMath - Tier 439.6Accuracy (%, 48 problems)97.9
Epoch AI - ECI160.93ECI Score97.8
FrontierMath - Tiers 1-3 (v2)87.72Accuracy (%, 285 private v2 problems)97.3
ARC-AGI-284.16Accuracy (%)96.3
ARC-AGI-195Accuracy (%)95.3
FrontierMath - Tier 4 (v2)78.05Accuracy (%, 41 private v2 problems)92.3
IMO-Bench88.1Advanced ProofBench Accuracy (%)90.9
SimpleQA Verified64.5Accuracy (%)87.5

Interactive version: theaggregate.ai/model?slug=gpt-5-5-pro-xhigh · How the rankings work · Data refreshed daily, snapshot 2026-07-22.