GPT-5.4 Mini (Non-reasoning) — benchmark results

GPT-5.4 Mini evaluated with reasoning disabled. Provider: OpenAI. Released 2026-03-17. Access: API.

Unified ELO 1596 ± 10, rank #480 of 1776 rated models, from 297 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Portuguese NLU - ScaLA PT74.28Linguistic acceptability Score (%)99.8
EuroEval Ukrainian NLU - ScaLA UK48.91Linguistic acceptability Score (%)99.5
EuroEval Croatian NLU60.28NLU Average Score (%)99
EuroEval English NLU - ScaLA EN68.83Linguistic acceptability Score (%)98.8
EuroEval Catalan NLU66.84NLU Average Score (%)98.6
EuroEval German NLU - ScaLA DE68.43Linguistic acceptability Score (%)98.5
EuroEval Spanish NLU61.33NLU Average Score (%)98.3
EuroEval Spanish NLU - ScaLA ES60.47Linguistic acceptability Score (%)98.1
EuroEval Polish NLU - ScaLA PL64.24Linguistic acceptability Score (%)97.9
EuroEval Italian NLU - ScaLA IT63.13Linguistic acceptability Score (%)97.5
EuroEval Portuguese NLU66.67NLU Average Score (%)97.2
EuroEval Albanian NLU - ScaLA SQ51.74Linguistic acceptability Score (%)96.5

Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.