GPT-5.4 Mini (xHigh): benchmark results
GPT-5.4 Mini evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-03-17. Access: API.
Unified ELO 1646 ± 1, rank #255 of 1761 rated models, from 110 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA Terminal-Bench Hard | 52.27 | Accuracy (%) | 95.7 |
| AA Global-MMLU-Lite - Burmese | 88.42 | Accuracy (%) | 93.7 |
| Vals AI AIME | 95.62 | Accuracy (%) | 91.1 |
| AA IFBench | 73.27 | Accuracy (%) | 90.6 |
| AA Global-MMLU-Lite - Swahili | 88.33 | Accuracy (%) | 90.5 |
| AA Global-MMLU-Lite - Chinese | 90.92 | Accuracy (%) | 87.4 |
| AA Global-MMLU-Lite - Bengali | 89.42 | Accuracy (%) | 86.5 |
| AA Global-MMLU-Lite - Indonesian | 90.83 | Accuracy (%) | 85.6 |
| AA Global-MMLU-Lite - Korean | 89.08 | Accuracy (%) | 85.6 |
| AA CritPt | 10 | Accuracy (%) | 85.5 |
| Vals AI SAGE | 50.81 | Accuracy (%) | 84.8 |
| AA Global-MMLU-Lite | 89.41 | Accuracy (%) | 84.7 |
Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.