GPT-5 (Minimal): benchmark results
GPT-5 evaluated at the minimal reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.
Unified ELO 1580 ± 1, rank #513 of 1761 rated models, from 196 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Norwegian NLU - ScaLA NB | 78.42 | Linguistic acceptability Score (%) | 99.2 |
| EuroEval Finnish | 69.28 | Average Score (%) | 98.9 |
| EuroEval French NLU - Allocine | 97.1 | Sentiment classification Score (%) | 98.8 |
| EuroEval Dutch | 76.21 | Average Score (%) | 98.5 |
| EuroEval Danish | 75.69 | Average Score (%) | 98.2 |
| Open Portuguese LLM - TweetSentBR | 78.78 | F1 (%) | 97.6 |
| EuroEval Dutch Common Sense Reasoning | 81.97 | Common Sense Reasoning Average Score (%) | 97.5 |
| EuroEval Portuguese Common Sense Reasoning | 93.7 | Common Sense Reasoning Average Score (%) | 97.4 |
| EuroEval Finnish NLU - ScaLA FI | 48.36 | Linguistic acceptability Score (%) | 97.3 |
| EuroEval Danish Common Sense Reasoning | 81.15 | Common Sense Reasoning Average Score (%) | 97.2 |
| EuroEval Spanish Common Sense Reasoning | 82.16 | Common Sense Reasoning Average Score (%) | 97.1 |
| EuroEval Danish Knowledge | 93.92 | Knowledge Average Score (%) | 97 |
Interactive version: theaggregate.ai/model?slug=gpt-5-minimal · How It Works · Data refreshed daily, snapshot 2026-09-05.