GPT-5 (High) — benchmark results

GPT-5 evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1801 ± 15, rank #139 of 1776 rated models, from 280 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
APEX v1 Big Law76.6Score (%)100
Aider polyglot coding leaderboard88Pass rate (%)100
DiscoX76.66Overall Score100
EuroEval Danish78.81Average Score (%)100
EuroEval Dutch Knowledge87.78Knowledge Average Score (%)100
EuroEval English Knowledge97.68Knowledge Average Score (%)100
EuroEval Finnish72.92Average Score (%)100
EuroEval French Knowledge88.34Knowledge Average Score (%)100
EuroEval German Knowledge93.41Knowledge Average Score (%)100
EuroEval Italian Knowledge92.29Knowledge Average Score (%)100
EuroEval Spanish Knowledge89.3Knowledge Average Score (%)100
EuroEval Swedish78.64Average Score (%)100

Interactive version: theaggregate.ai/model?slug=gpt-5-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.