GPT-5.4 Mini (xHigh): benchmark results

GPT-5.4 Mini evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-03-17. Access: API.

Unified ELO 1646 ± 1, rank #255 of 1761 rated models, from 110 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Terminal-Bench Hard52.27Accuracy (%)95.7
AA Global-MMLU-Lite - Burmese88.42Accuracy (%)93.7
Vals AI AIME95.62Accuracy (%)91.1
AA IFBench73.27Accuracy (%)90.6
AA Global-MMLU-Lite - Swahili88.33Accuracy (%)90.5
AA Global-MMLU-Lite - Chinese90.92Accuracy (%)87.4
AA Global-MMLU-Lite - Bengali89.42Accuracy (%)86.5
AA Global-MMLU-Lite - Indonesian90.83Accuracy (%)85.6
AA Global-MMLU-Lite - Korean89.08Accuracy (%)85.6
AA CritPt10Accuracy (%)85.5
Vals AI SAGE50.81Accuracy (%)84.8
AA Global-MMLU-Lite89.41Accuracy (%)84.7

Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini-xhigh · How It Works · Data refreshed daily, snapshot 2026-09-05.