GPT-5.4 Nano (xHigh) — benchmark results
GPT-5.4 Nano evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-03-17. Access: API.
Unified ELO 1782 ± 25, rank #160 of 1776 rated models, from 49 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA IFBench | 75.92 | Accuracy (%) | 94.5 |
| AA CritPt | 9.25 | Accuracy (%) | 90.9 |
| AA Terminal-Bench Hard | 42.42 | Accuracy (%) | 89.2 |
| AA SciCode | 46.88 | Accuracy (%) | 88.5 |
| Artificial Analysis Intelligence Index | 38.24 | Intelligence Index | 88.4 |
| AA Omniscience - Software Engineering (SWE) - Julia | 40 | Accuracy (%) | 86.8 |
| AA Humanity's Last Exam | 26.46 | Accuracy (%) | 86.4 |
| AA Long Context Reasoning | 66 | Accuracy (%) | 84.1 |
| AA Omniscience - Software Engineering (SWE) - Kotlin | 40 | Accuracy (%) | 83 |
| AA Omniscience - Software Engineering (SWE) - Swift | 60 | Accuracy (%) | 80.9 |
| AA Omniscience - Software Engineering (SWE) - JavaScript | 49.09 | Accuracy (%) | 80.4 |
| Tau3 Banking | 21.03 | Success Rate (%) | 79.6 |
Interactive version: theaggregate.ai/model?slug=gpt-5-4-nano-xhigh · How the rankings work · Data refreshed daily, snapshot 2026-07-22.