Claude 3.5 Sonnet (20240620): benchmark results

June 2024 Claude 3.5 Sonnet snapshot, kept separate from later Claude 3.5 Sonnet rows. Provider: Anthropic. Released 2024-06-20. Access: API.

Unified ELO 1599 ± 1, rank #269 of 1392 rated models, from 723 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Clembench Multimodal v1.6.580.77clemscore (self-reported)100
HELM EWoK - Material Dynamics90.9EM100
HELM EWoK - Material Properties93.95EM100
HELM EWoK - Physical Relations83.61EM100
HELM NaturalQuestions (Closed)50.16F1 (%)100
HELM ThaiExam - IC87.37EM100
HELM ThaiExam - ONET73.46EM100
HELM ThaiExam - TGAT83.08EM100
HELM ThaiExam - ThaiExam75.1EM100
LLM Game Benchmark42.17Source Win Rate (self-reported)100
MEGA-Bench Task - Autorater 3D Model Texturing85.7Task Score (%)100
MEGA-Bench Task - COCO OOD Global Image Retrieval By Query Property86Task Score (%)100

Interactive version: theaggregate.ai/model?slug=claude-3-5-sonnet-20240620 · How It Works · Data refreshed daily, snapshot 2026-09-05.