GPT-5 (Minimal): benchmark results

GPT-5 evaluated at the minimal reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1580 ± 1, rank #513 of 1761 rated models, from 196 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Norwegian NLU - ScaLA NB78.42Linguistic acceptability Score (%)99.2
EuroEval Finnish69.28Average Score (%)98.9
EuroEval French NLU - Allocine97.1Sentiment classification Score (%)98.8
EuroEval Dutch76.21Average Score (%)98.5
EuroEval Danish75.69Average Score (%)98.2
Open Portuguese LLM - TweetSentBR78.78F1 (%)97.6
EuroEval Dutch Common Sense Reasoning81.97Common Sense Reasoning Average Score (%)97.5
EuroEval Portuguese Common Sense Reasoning93.7Common Sense Reasoning Average Score (%)97.4
EuroEval Finnish NLU - ScaLA FI48.36Linguistic acceptability Score (%)97.3
EuroEval Danish Common Sense Reasoning81.15Common Sense Reasoning Average Score (%)97.2
EuroEval Spanish Common Sense Reasoning82.16Common Sense Reasoning Average Score (%)97.1
EuroEval Danish Knowledge93.92Knowledge Average Score (%)97

Interactive version: theaggregate.ai/model?slug=gpt-5-minimal · How It Works · Data refreshed daily, snapshot 2026-09-05.