GPT-5: benchmark results

OpenAI's standard GPT-5 model for broad reasoning, coding, writing, and tool-use tasks. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1690 ± 1, rank #66 of 1392 rated models, from 1155 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ASCIIEval55.9Macro-Avg Accuracy (%)100
AfroBench77.74Average Score (%)100
BIRD-Interact (a-Interact)25.52Normalized Reward100
Beyond Binary84.52NDCG@All (self-reported)100
Blueprint-Bench0.43Similarity Score100
Bongard in Wonderland64Problems Solved (out of 100)100
BrowserGym WorkArena L269.4Success Rate (%)100
CAIA - Pass@1 (With Tools)70.2Pass@1 (%)100
CAIA - Pass@1 (Without Tools)28.1Pass@1 (%)100
CMT-Benchmark30Pass@1 (%)100
Can Large Language Models Handle Discourse Par72.4Overall Avg (MS) (self-reported)100
CodeClash - Poker1599ELO100

Interactive version: theaggregate.ai/model?slug=gpt-5 · How It Works · Data refreshed daily, snapshot 2026-09-05.