GPT-5.4 (Non-reasoning) — benchmark results

GPT-5.4 evaluated with reasoning disabled. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1723 ± 32, rank #234 of 1776 rated models, from 45 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Julia72Accuracy (%)97.1
AA Omniscience - Software Engineering (SWE) - Python74.5Accuracy (%)94.5
AA Omniscience - Software Engineering (SWE) - Rust78Accuracy (%)93.9
AA Omniscience - Software Engineering (SWE) - Dart58Accuracy (%)93.8
UGI - Natural Intelligence57.24NatInt Score93.5
AA Omniscience - Software Engineering (SWE) - TypeScript70Accuracy (%)93.2
UGI - Writing57.99Writing Score92.7
AA Omniscience - Software Engineering (SWE) - R54Accuracy (%)91.9
AA Omniscience - Software Engineering (SWE)64.6Accuracy (%)91.5
AA Omniscience - Software Engineering (SWE) - C75Accuracy (%)91.3
Epoch AI - ECI156.12ECI Score91.2
AA Omniscience - Software Engineering (SWE) - Kotlin58Accuracy (%)91

Interactive version: theaggregate.ai/model?slug=gpt-5-4-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.