GPT-5 (High): benchmark results

GPT-5 evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1680 ± 1, rank #152 of 1761 rated models, from 334 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Aider polyglot coding leaderboard88Pass rate (%)100
DiscoX76.66Overall Score100
EuroEval Danish78.81Average Score (%)100
EuroEval Dutch Knowledge87.78Knowledge Average Score (%)100
EuroEval English Knowledge97.68Knowledge Average Score (%)100
EuroEval Finnish72.92Average Score (%)100
EuroEval French Knowledge88.34Knowledge Average Score (%)100
EuroEval German Knowledge93.41Knowledge Average Score (%)100
EuroEval Italian Knowledge92.29Knowledge Average Score (%)100
EuroEval Spanish Knowledge89.3Knowledge Average Score (%)100
EuroEval Swedish78.64Average Score (%)100
FlagEval VQA - Multi-Image Analysis62.5Score100

Interactive version: theaggregate.ai/model?slug=gpt-5-high · How It Works · Data refreshed daily, snapshot 2026-09-05.