Claude 3.5 Sonnet (20240620) — benchmark results

June 2024 Claude 3.5 Sonnet snapshot, kept separate from later Claude 3.5 Sonnet rows. Provider: Anthropic. Released 2024-06-20. Access: API.

Unified ELO 1670 ± 9, rank #320 of 1776 rated models, from 687 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM EWoK - Material Dynamics90.9EM100
HELM EWoK - Material Properties93.95EM100
HELM EWoK - Physical Relations83.61EM100
HELM NaturalQuestions (Closed)50.16F1 (%)100
HELM ThaiExam - IC87.37EM100
HELM ThaiExam - ONET73.46EM100
HELM ThaiExam - TGAT83.08EM100
HELM ThaiExam - ThaiExam75.1EM100
LLM Game Benchmark42.2Source Win Rate (self-reported)100
LiveBench AMPS Hard49Score100
LiveBench Coding Completion68.42Score100
LiveBench LCB Generation58Score100

Interactive version: theaggregate.ai/model?slug=claude-3-5-sonnet-20240620 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.