GPT-5 (Minimal) — benchmark results

GPT-5 evaluated at the minimal reasoning-effort setting. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1586 ± 16, rank #511 of 1776 rated models, from 190 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Norwegian NLU - ScaLA NB78.42Linguistic acceptability Score (%)99.2
EuroEval Finnish69.28Average Score (%)98.9
EuroEval French NLU - Allocine97.1Sentiment classification Score (%)98.8
EuroEval Dutch76.21Average Score (%)98.5
EuroEval Danish75.69Average Score (%)98.2
EuroEval Dutch Common Sense Reasoning81.97Common Sense Reasoning Average Score (%)97.5
EuroEval Portuguese Common Sense Reasoning93.7Common Sense Reasoning Average Score (%)97.4
EuroEval Finnish NLU - ScaLA FI48.36Linguistic acceptability Score (%)97.3
EuroEval Danish Common Sense Reasoning81.15Common Sense Reasoning Average Score (%)97.2
EuroEval Spanish Common Sense Reasoning82.16Common Sense Reasoning Average Score (%)97.1
EuroEval Danish Knowledge93.92Knowledge Average Score (%)97
EuroEval Finnish Common Sense Reasoning82.09Common Sense Reasoning Average Score (%)97

Interactive version: theaggregate.ai/model?slug=gpt-5-minimal · How the rankings work · Data refreshed daily, snapshot 2026-07-22.