GPT-5.4 (Low) — benchmark results

GPT-5.4 evaluated at the low reasoning-effort setting. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1849 ± 30, rank #104 of 1776 rated models, from 51 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Julia88Accuracy (%)100
AA Omniscience - Software Engineering (SWE) - R72Accuracy (%)98.9
AA Omniscience - Software Engineering (SWE) - JavaScript85.45Accuracy (%)97.8
AA Omniscience - Software Engineering (SWE) - Java65Accuracy (%)97.7
AA Omniscience - Software Engineering (SWE) - Python85Accuracy (%)97.7
UGI - Natural Intelligence67.6NatInt Score97.6
AA Omniscience - Software Engineering (SWE)79.4Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - Kotlin74Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - TypeScript86.67Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - C86Accuracy (%)97.2
AA Omniscience - Software Engineering (SWE) - Dart68Accuracy (%)97.1
AA Omniscience - Software Engineering (SWE) - Go74Accuracy (%)96.7

Interactive version: theaggregate.ai/model?slug=gpt-5-4-low · How the rankings work · Data refreshed daily, snapshot 2026-07-22.