GPT-5.4 (Medium): benchmark results

GPT-5.4 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1703 ± 1, rank #92 of 1761 rated models, from 50 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SMDD-Bench40.2Pass Rate (%)100
AI for Education Pedagogy - Social studies90Accuracy (%)97.7
ALE-Bench1520.72Performance (Self-Refine x1) (self-reported)96.6
AI for Education Visual Maths - Geometry86.92Accuracy (%)95.9
AI for Education Visual Maths - Measurement97.3Accuracy (%)95.9
AI for Education Visual Maths - Statistics and Probability71.43Accuracy (%)95.9
AI for Education Pedagogy - Maths92.06Accuracy (%)95.6
LLM Chess (Saplin)1252.9ELO95
AI for Education Visual Maths86.5Accuracy (%)94.6
AI for Education Visual Maths - Algebra96.15Accuracy (%)94.6
AI for Education Visual Reasoning - pattern completion (linear)87.2Accuracy (%)93.1
AI for Education Visual Reasoning - reasoning by analogy81.4Accuracy (%)92.3

Interactive version: theaggregate.ai/model?slug=gpt-5-4-medium · How It Works · Data refreshed daily, snapshot 2026-09-05.