GPT-5.5 (High) — benchmark results

GPT-5.5 evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 2011 ± 26, rank #20 of 1776 rated models, from 96 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - C92Accuracy (%)100
Buyout Game (Lechmazur)1975.4Bradley-Terry Rating100
PACT (Lechmazur)1607CMS Points100
Shader Benchmark242.2Avg judge score (0-500, render fails count 0)100
SlopCodeBench28.06Isolated Solved (%)100
UGI - Natural Intelligence79.27NatInt Score100
AA Omniscience - Software Engineering (SWE) - HTML90Accuracy (%)99.7
AA Omniscience - Science, Engineering & Mathematics52.3Accuracy (%)99.6
AA Omniscience - Software Engineering (SWE) - R74Accuracy (%)99.6
AA GPQA Diamond93.23Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE)83.9Accuracy (%)99.3
LLM Chess (Saplin)1528.4ELO99.3

Interactive version: theaggregate.ai/model?slug=gpt-5-5-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.