Claude Sonnet 5 (High) — benchmark results

Claude Sonnet 5 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-06-30. Access: API.

Unified ELO 1970 ± 24, rank #36 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LisanBench0.4Mean Path Length / Current Maximum95.3
Chatbot Arena (Code)1544Elo91.9
Chatbot Arena (Text)1461Elo90
Agent Arena - Praise vs Complaint16.88Praise vs Complaint (%)86.5
WeirdML68.78Average Score86.1
Chatbot Arena (Vision)1272Arena Score85.8
Multi-turn Debate (Lechmazur)1618.5Bradley-Terry Rating85
Epoch AI - ECI153.2ECI Score80
Agent Arena8.66Net Improvement (%)78.4
Agent Arena - Confirmed Success8.14Confirmed Success (%)73
Chatbot Arena (Document)1471Elo71
Opus Magnum Bench26.55Human-normalized score (%)66.7

Interactive version: theaggregate.ai/model?slug=claude-sonnet-5-high · How the rankings work · Data refreshed daily, snapshot 2026-07-22.