GPT-5.4 (Medium) — benchmark results

GPT-5.4 evaluated at the medium reasoning-effort setting. Provider: OpenAI. Released 2026-03-06. Access: API.

Unified ELO 1930 ± 28, rank #48 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SMDD-Bench40.2Pass Rate (%)100
AI for Education Visual Maths86.5Accuracy (%)98.3
AI for Education Visual Maths - Geometry86.92Accuracy (%)98.3
AI for Education Visual Maths - Measurement97.3Accuracy (%)98.3
AI for Education Visual Maths - Statistics and Probability71.43Accuracy (%)98.3
AI for Education Pedagogy - Maths92.06Accuracy (%)97.5
AI for Education Pedagogy - Social studies90Accuracy (%)97.5
LLM Chess (Saplin)1252.9ELO97.1
AI for Education Visual Reasoning - reasoning by analogy81.4Accuracy (%)96.8
AI for Education Visual Reasoning - pattern completion (linear)87.2Accuracy (%)96
AI for Education Visual Maths - Algebra96.15Accuracy (%)95.8
AI for Education SEND83.94Accuracy (%)94.1

Interactive version: theaggregate.ai/model?slug=gpt-5-4-medium · How the rankings work · Data refreshed daily, snapshot 2026-07-22.