GPT-5 (High): benchmark results
GPT-5 evaluated at the high reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.
Unified ELO 1680 ± 1, rank #152 of 1761 rated models, from 334 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Aider polyglot coding leaderboard | 88 | Pass rate (%) | 100 |
| DiscoX | 76.66 | Overall Score | 100 |
| EuroEval Danish | 78.81 | Average Score (%) | 100 |
| EuroEval Dutch Knowledge | 87.78 | Knowledge Average Score (%) | 100 |
| EuroEval English Knowledge | 97.68 | Knowledge Average Score (%) | 100 |
| EuroEval Finnish | 72.92 | Average Score (%) | 100 |
| EuroEval French Knowledge | 88.34 | Knowledge Average Score (%) | 100 |
| EuroEval German Knowledge | 93.41 | Knowledge Average Score (%) | 100 |
| EuroEval Italian Knowledge | 92.29 | Knowledge Average Score (%) | 100 |
| EuroEval Spanish Knowledge | 89.3 | Knowledge Average Score (%) | 100 |
| EuroEval Swedish | 78.64 | Average Score (%) | 100 |
| FlagEval VQA - Multi-Image Analysis | 62.5 | Score | 100 |
Interactive version: theaggregate.ai/model?slug=gpt-5-high · How It Works · Data refreshed daily, snapshot 2026-09-05.