GPT-5 (Minimal) — benchmark results
GPT-5 evaluated at the minimal reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.
Unified ELO 1586 ± 16, rank #511 of 1776 rated models, from 190 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Norwegian NLU - ScaLA NB | 78.42 | Linguistic acceptability Score (%) | 99.2 |
| EuroEval Finnish | 69.28 | Average Score (%) | 98.9 |
| EuroEval French NLU - Allocine | 97.1 | Sentiment classification Score (%) | 98.8 |
| EuroEval Dutch | 76.21 | Average Score (%) | 98.5 |
| EuroEval Danish | 75.69 | Average Score (%) | 98.2 |
| EuroEval Dutch Common Sense Reasoning | 81.97 | Common Sense Reasoning Average Score (%) | 97.5 |
| EuroEval Portuguese Common Sense Reasoning | 93.7 | Common Sense Reasoning Average Score (%) | 97.4 |
| EuroEval Finnish NLU - ScaLA FI | 48.36 | Linguistic acceptability Score (%) | 97.3 |
| EuroEval Danish Common Sense Reasoning | 81.15 | Common Sense Reasoning Average Score (%) | 97.2 |
| EuroEval Spanish Common Sense Reasoning | 82.16 | Common Sense Reasoning Average Score (%) | 97.1 |
| EuroEval Danish Knowledge | 93.92 | Knowledge Average Score (%) | 97 |
| EuroEval Finnish Common Sense Reasoning | 82.09 | Common Sense Reasoning Average Score (%) | 97 |
Interactive version: theaggregate.ai/model?slug=gpt-5-minimal · How the rankings work · Data refreshed daily, snapshot 2026-07-22.