GPT-5.4 (Non-reasoning): benchmark results

GPT-5.4 evaluated with reasoning disabled. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1628 ± 1, rank #326 of 1761 rated models, from 34 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence57.24NatInt Score92.8
UGI - Writing57.99Writing Score92
CritPt60Accuracy (self-reported)91.9
AA Omniscience - Software Engineering (SWE)65.3Accuracy (%)87.5
AA Terminal-Bench Hard37.88Accuracy (%)84.9
UGI Leaderboard47.01UGI Score84
AA Omniscience - Health34.7Accuracy (%)80.1
AA-Omniscience Accuracy37.38Accuracy (%)79.9
AA Omniscience - Law28.8Accuracy (%)79.7
AA Omniscience - Business27.8Accuracy (%)78.1
AA Omniscience - Humanities & Social Sciences31.7Accuracy (%)77.5
Buyout Game (Lechmazur)1654Bradley-Terry Rating77.1

Interactive version: theaggregate.ai/model?slug=gpt-5-4-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.