GPT-5.4: benchmark results

OpenAI's standard GPT-5.4 model for general-purpose reasoning, coding, and writing. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1704 ± 1, rank #48 of 1392 rated models, from 795 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - Brainstorming0.97JRT z-score100
AGC-Bench - STEM0.81JRT z-score100
AGC-Bench - Story / Narrative0.89JRT z-score100
AGC-Bench - irfl1.59Dataset z-score100
AGC-Bench - permpst2.14Dataset z-score100
AGC-Bench - pollux_creativity1.22Dataset z-score100
AGC-Bench - ss_gen1.51Dataset z-score100
CPCD-Bench4.78SR (LLM-as-a-Judge) (self-reported)100
CUDABeaver29.1pass@5 (self-reported)100
CUSP Science60.3FRQ Pass (%)100
ChildAgentEval53Total (self-reported)100
ClawsBench - Capability78.16Best-configuration Score (-100 to 100)100

Interactive version: theaggregate.ai/model?slug=gpt-5-4 · How It Works · Data refreshed daily, snapshot 2026-09-05.