GPT-5.5 (Non-reasoning): benchmark results

Provider: OpenAI. Released 2026-04-23. Access: API.

Unified ELO 1653 ± 1, rank #326 of 3078 rated models, from 87 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
RuleWeaver - Same-Source - Rubric Score53.83Judge rubric score (0-100)100
RuleWeaver - Same-Source - Rule Precision74.58Correctly applied share of cited rules (%)100
AA-Omniscience Index - Software Engineering (SWE) - TypeScript64.44Omniscience Index94.6
UGI - Natural Intelligence62.57NatInt Score94.6
AA Terminal-Bench Hard49.24Accuracy (%)94.5
AA-Omniscience Index - Software Engineering (SWE) - Julia44Omniscience Index93
AA-Omniscience Index - Software Engineering (SWE) - Kotlin42Omniscience Index92.3
AA-Omniscience Index - Software Engineering (SWE) - Python53.5Omniscience Index91.5
Wolfram LLM Benchmarking Project62.8Correct Functionality (%)91.5
AA-Omniscience Index - Software Engineering (SWE) - PHP56Omniscience Index90.8
PLCC - Culture & Tradition93Accuracy (%)90.7
ComboShoppingBench - Response Quality93.1Pass rate (%; LLM-judged)90.5

Interactive version: theaggregate.ai/model?slug=gpt-5-5-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-19.