GPT-5.5 (Medium) — benchmark results

GPT-5.5 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 1997 ± 34, rank #26 of 1776 rated models, from 60 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM Chess (Saplin)1532.2ELO100
UGI - Natural Intelligence77.12NatInt Score99.8
AA Omniscience - Software Engineering (SWE) - HTML90Accuracy (%)99.7
AA Omniscience - Software Engineering (SWE) - R74Accuracy (%)99.6
AA Omniscience - Software Engineering (SWE) - Python89Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE) - Rust86Accuracy (%)99.2
AA Omniscience - Software Engineering (SWE) - C88Accuracy (%)99.1
AA Omniscience - Software Engineering (SWE) - PHP92Accuracy (%)99.1
AA Omniscience - Software Engineering (SWE) - JavaScript88.18Accuracy (%)99
AA Omniscience - Health48.8Accuracy (%)98.9
AA Omniscience - Software Engineering (SWE) - Dart76Accuracy (%)98.9
AA Omniscience - Software Engineering (SWE) - Java69Accuracy (%)98.8

Interactive version: theaggregate.ai/model?slug=gpt-5-5-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.