Claude 3 Opus (20240229): benchmark results
February 29, 2024 Claude 3 Opus snapshot, tracked separately from generic Claude 3 Opus rows. Provider: Anthropic. Released 2024-02-29. Access: API.
Unified ELO 1558 ± 1, rank #407 of 1392 rated models, from 121 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| HELM EWoK - Agent Properties | 94.46 | EM | 100 |
| HELM Finance - FinanceBench | 70 | Correct Answer | 100 |
| LogicKor - Grammar | 9.64 | Score (0-10) | 100 |
| Enkrypt AI - Risk Score | 10.58 | Risk Score | 99.2 |
| Enkrypt AI - Safety Risk | 7.34 | Risk Score | 99.2 |
| Enkrypt AI - Bias Risk | 25.58 | Risk Score | 98.5 |
| LogicKor - Writing | 9.78 | Score (0-10) | 97.7 |
| HELM ThaiExam - IC | 76.84 | EM | 97.6 |
| HELM ThaiExam - ONET | 66.67 | EM | 97.6 |
| HELM ThaiExam - TGAT | 80 | EM | 97.6 |
| HELM ThaiExam - ThaiExam | 68.57 | EM | 97.6 |
| LogicKor - Coding | 9.85 | Score (0-10) | 97.5 |
Interactive version: theaggregate.ai/model?slug=claude-3-opus-20240229 · How It Works · Data refreshed daily, snapshot 2026-09-05.