GPT-5.4 Mini — benchmark results

OpenAI's smaller, faster GPT-5.4 tier for cost-efficient reasoning workloads. Provider: OpenAI. Released 2026-03-17. Access: API.

Unified ELO 1696 ± 12, rank #276 of 1776 rated models, from 256 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - hypobench0.48Dataset z-score100
CalBench149Excess (self-reported)100
GACL - Battleship85.94Normalized Score (0-100)100
TempGlitch52.4Acc. (1 FPS) (self-reported)100
AGC-Bench - pun_eval1.4Dataset z-score97.6
AGC-Bench - humor_transfer0.97Dataset z-score96.3
LLM-as-a-Reviewer99.7Low (NeurIPS 2022) (self-reported)95.5
AGC-Bench - pollux_creativity0.92Dataset z-score95.1
CritPt10Accuracy (self-reported)94.5
SLR-Bench - Hard28Accuracy (%)94.5
AA-LCR69.3Score (self-reported)93.5
Chartographer94ChartQA OA (self-reported)92.9

Interactive version: theaggregate.ai/model?slug=gpt-5-4-mini · How the rankings work · Data refreshed daily, snapshot 2026-07-22.