GPT-5.5 (Low): benchmark results

GPT-5.5 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 1680 ± 1, rank #155 of 1761 rated models, from 38 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence71.39NatInt Score98.2
AA Terminal-Bench Hard52.27Accuracy (%)95.7
AA Omniscience - Software Engineering (SWE)82.9Accuracy (%)95.2
AA Omniscience - Business46.8Accuracy (%)95
AA-Omniscience Accuracy54.85Accuracy (%)94.6
AA Omniscience - Health46.8Accuracy (%)94
AA Omniscience - Humanities & Social Sciences51.3Accuracy (%)93
AA Long Context Reasoning81Accuracy (%)92.6
AA Omniscience - Law51.1Accuracy (%)92.4
AA Omniscience - Science, Engineering & Mathematics50.2Accuracy (%)92.4
UGI - Writing58.69Writing Score92.2
AA GPQA Diamond91.01Accuracy (%)91.3

Interactive version: theaggregate.ai/model?slug=gpt-5-5-low · How It Works · Data refreshed daily, snapshot 2026-09-05.