GPT-5.5 (Low) — benchmark results

GPT-5.5 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 1904 ± 23, rank #62 of 1776 rated models, from 50 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Dart78Accuracy (%)99.6
AA Omniscience - Software Engineering (SWE) - Swift88Accuracy (%)99.3
AA Omniscience - Software Engineering (SWE) - PHP92Accuracy (%)99.1
AA Omniscience - Software Engineering (SWE) - Python88Accuracy (%)98.9
UGI - Natural Intelligence71.39NatInt Score98.7
AA Omniscience - Software Engineering (SWE) - HTML86Accuracy (%)98.5
AA Omniscience - Software Engineering (SWE) - Julia76Accuracy (%)98.3
AA Omniscience - Software Engineering (SWE) - TypeScript88.89Accuracy (%)98.3
AA Omniscience - Software Engineering (SWE)82.2Accuracy (%)98
AA Omniscience - Software Engineering (SWE) - C87Accuracy (%)98
AA Omniscience - Software Engineering (SWE) - Java66Accuracy (%)98
AA Omniscience - Software Engineering (SWE) - Kotlin78Accuracy (%)97.7

Interactive version: theaggregate.ai/model?slug=gpt-5-5-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.