GPT-5.4 Mini (xHigh) — benchmark results

GPT-5.4 Mini evaluated at the xhigh reasoning-effort setting. Provider: OpenAI. Released 2026-03-17. Access: API.

Unified ELO 1810 ± 16, rank #131 of 1776 rated models, from 81 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Terminal-Bench Hard52.27Accuracy (%)95.7
AA Global-MMLU-Lite - Burmese88.42Accuracy (%)93.6
AA Omniscience - Software Engineering (SWE) - Kotlin64Accuracy (%)93.3
AA Omniscience - Software Engineering (SWE) - JavaScript71.82Accuracy (%)92.5
AA Omniscience - Software Engineering (SWE) - TypeScript68.89Accuracy (%)92.3
AA SciCode49.88Accuracy (%)92
AA Long Context Reasoning69.33Accuracy (%)91.7
AA CritPt10Accuracy (%)91.6
AA Omniscience - Software Engineering (SWE) - R52Accuracy (%)91
AA IFBench73.27Accuracy (%)90.6
AA Global-MMLU-Lite - Swahili88.33Accuracy (%)90.5
AA Omniscience - Software Engineering (SWE) - Python63.5Accuracy (%)90.3

Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini-xhigh · How the rankings work · Data refreshed daily, snapshot 2026-07-22.