Claude 3 Sonnet (20240229): benchmark results

February 29, 2024 Claude 3 Sonnet snapshot, tracked separately from generic Claude 3 Sonnet rows. Provider: Anthropic. Released 2024-03-04. Access: API.

Unified ELO 1469 ± 1, rank #844 of 1392 rated models, from 101 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LogicKor - Coding9.85Score (0-10)97.5
LogicKor - Grammar8.28Score (0-10)95.8
BiGGen-Bench4.01Average Score (1-5)94.1
Enkrypt AI - Jailbreak Risk1.97Risk Score93.1
Enkrypt AI - Safety Risk17.37Risk Score93.1
LogicKor - Understanding9.71Score (0-10)92.4
HELM Safety Anthropic Red Team99.8LM Evaluated Safety score (%)91.9
Enkrypt AI - Toxicity Risk0.36Risk Score91.4
LogicKor - Writing9.42Score (0-10)89.3
HELM ThaiExam - TGAT73.85EM89
HELM Finance - FinanceBench65Correct Answer88.1
LogicKor - Single-Turn8.54Score (0-10)88

Interactive version: theaggregate.ai/model?slug=claude-3-sonnet-20240229 · How It Works · Data refreshed daily, snapshot 2026-09-05.