GPT-5.4 Mini (Non-reasoning) — benchmark results
GPT-5.4 Mini evaluated with reasoning disabled. Provider: OpenAI. Released 2026-03-17. Access: API.
Unified ELO 1596 ± 10, rank #480 of 1776 rated models, from 297 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Portuguese NLU - ScaLA PT | 74.28 | Linguistic acceptability Score (%) | 99.8 |
| EuroEval Ukrainian NLU - ScaLA UK | 48.91 | Linguistic acceptability Score (%) | 99.5 |
| EuroEval Croatian NLU | 60.28 | NLU Average Score (%) | 99 |
| EuroEval English NLU - ScaLA EN | 68.83 | Linguistic acceptability Score (%) | 98.8 |
| EuroEval Catalan NLU | 66.84 | NLU Average Score (%) | 98.6 |
| EuroEval German NLU - ScaLA DE | 68.43 | Linguistic acceptability Score (%) | 98.5 |
| EuroEval Spanish NLU | 61.33 | NLU Average Score (%) | 98.3 |
| EuroEval Spanish NLU - ScaLA ES | 60.47 | Linguistic acceptability Score (%) | 98.1 |
| EuroEval Polish NLU - ScaLA PL | 64.24 | Linguistic acceptability Score (%) | 97.9 |
| EuroEval Italian NLU - ScaLA IT | 63.13 | Linguistic acceptability Score (%) | 97.5 |
| EuroEval Portuguese NLU | 66.67 | NLU Average Score (%) | 97.2 |
| EuroEval Albanian NLU - ScaLA SQ | 51.74 | Linguistic acceptability Score (%) | 96.5 |
Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.