GPT-5 — benchmark results

OpenAI's standard GPT-5 model for broad reasoning, coding, writing, and tool-use tasks. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1761 ± 8, rank #177 of 1776 rated models, from 918 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
ASCIIEval55.9Macro-Avg Accuracy (%)100
AfroBench77.74Average Score (%)100
ArtifactsBench72.55AVG (self-reported)100
BIRD-Interact (a-Interact)25.52Normalized Reward100
Beyond Binary84.52NDCG@All (self-reported)100
Blueprint-Bench0.43Similarity Score100
Bongard in Wonderland64Problems Solved (out of 100)100
BrowserGym WorkArena L269.4Success Rate (%)100
CAIA - Pass@1 (With Tools)70.2Pass@1 (%)100
CAIA - Pass@1 (Without Tools)28.1Pass@1 (%)100
CMT-Benchmark30Pass@1 (%)100
Can Large Language Models Handle Discourse Par72.4Overall Avg (MS) (self-reported)100

Interactive version: theaggregate.ai/model?slug=gpt-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.