GPT-5 (2025-08-07) — benchmark results

August 7, 2025 GPT-5 snapshot, tracked when sources report the dated API model. Provider: OpenAI. Released 2025-08-07. Access: API.

Unified ELO 1661 ± 10, rank #342 of 1776 rated models, from 185 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM MedHELM - ACI-Bench4.86Jury Score100
HELM MedHELM - Administration & Workflow86.67Mean win rate100
HELM MedHELM - DischargeMe4.67Jury Score100
HELM MedHELM - HeadQA93.7EM100
HELM MedHELM - MIMIC-BHC4.13Jury Score100
HELM MedHELM - MIMIC-IV Billing Code42.9MIMICBillingF1100
HELM MedHELM - MIMIC-RRS4.72Jury Score100
HELM MedHELM - MedMCQA84.7EM100
HELM MedHELM - MedQA96.82EM100
HELM MedHELM - SHC-CDI62.4EM100
OpenCompass Multimodal - MMMU81.8Score (%)100
OpenVLM HallusionBench - fAcc62.4Accuracy (%)100

Interactive version: theaggregate.ai/model?slug=gpt-5-2025-08-07 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.