Claude Sonnet 5 (High): benchmark results

Claude Sonnet 5 evaluated at the high reasoning-effort setting. Provider: Anthropic. Released 2026-06-30. Access: API.

Unified ELO 1668 ± 1, rank #186 of 1761 rated models, from 52 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Agent Arena - Steerability12.29Steerability (%)96.5
Chatbot Arena (Text - Coding)1521Arena Score94
LisanBench0.37Mean Path Length / Current Maximum93.5
Chatbot Arena (Text - German)1477Arena Score92.7
Chatbot Arena (Text - Instruction Following)1465Arena Score91.9
Chatbot Arena (Text - Longer Query)1482Arena Score90.8
Chatbot Arena (Text - Math)1474Arena Score90.2
Chatbot Arena (Text - Hard Prompts)1490Arena Score90
Chatbot Arena (Text - Russian)1472Arena Score89.9
Chatbot Arena (Text - English)1474Arena Score89.7
Chatbot Arena (Text)1462Elo88.2
Chatbot Arena (Text - Japanese)1447Arena Score87.9

Interactive version: theaggregate.ai/model?slug=claude-sonnet-5-high · How It Works · Data refreshed daily, snapshot 2026-09-05.