Claude 3 Sonnet (20240229) — benchmark results

February 29, 2024 Claude 3 Sonnet snapshot, tracked separately from generic Claude 3 Sonnet rows. Provider: Anthropic. Released 2024-03-04. Access: API.

Unified ELO 1451 ± 24, rank #991 of 1776 rated models, from 94 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LogicKor - Coding9.85Score (0-10)97.6
LogicKor - Grammar8.28Score (0-10)95.6
BiGGen-Bench4.01Average Score (1-5)94.1
LogicKor - Understanding9.71Score (0-10)93.1
HELM Safety Anthropic Red Team99.8LM Evaluated Safety score (%)91.9
LogicKor - Writing9.42Score (0-10)91.2
LogicKor - Single-Turn8.54Score (0-10)90.5
HELM ThaiExam - TGAT73.85EM89
LogicKor - Multi-Turn8.4Score (0-10)88.7
LogicKor - Reasoning8.21Score (0-10)88.5
HELM Finance - FinanceBench65Correct Answer88.1
LogicKor8.38Score (0-10)87.8

Interactive version: theaggregate.ai/model?slug=claude-3-sonnet-20240229 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.