Claude 3 Opus (20240229): benchmark results

February 29, 2024 Claude 3 Opus snapshot, tracked separately from generic Claude 3 Opus rows. Provider: Anthropic. Released 2024-02-29. Access: API.

Unified ELO 1558 ± 1, rank #407 of 1392 rated models, from 121 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM EWoK - Agent Properties94.46EM100
HELM Finance - FinanceBench70Correct Answer100
LogicKor - Grammar9.64Score (0-10)100
Enkrypt AI - Risk Score10.58Risk Score99.2
Enkrypt AI - Safety Risk7.34Risk Score99.2
Enkrypt AI - Bias Risk25.58Risk Score98.5
LogicKor - Writing9.78Score (0-10)97.7
HELM ThaiExam - IC76.84EM97.6
HELM ThaiExam - ONET66.67EM97.6
HELM ThaiExam - TGAT80EM97.6
HELM ThaiExam - ThaiExam68.57EM97.6
LogicKor - Coding9.85Score (0-10)97.5

Interactive version: theaggregate.ai/model?slug=claude-3-opus-20240229 · How It Works · Data refreshed daily, snapshot 2026-09-05.