Claude 3 Haiku (20240307): benchmark results

March 7, 2024 Claude 3 Haiku snapshot, tracked separately from generic Claude 3 Haiku rows. Provider: Anthropic. Released 2024-03-07. Access: API.

Unified ELO 1455 ± 1, rank #920 of 1392 rated models, from 117 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Safety Anthropic Red Team100LM Evaluated Safety score (%)100
BiGGen-Bench3.95Average Score (1-5)92.2
LogicKor - Grammar8.07Score (0-10)91.6
LogicKor - Understanding9.64Score (0-10)89.9
Enkrypt AI - Toxicity Risk0.55Risk Score87.8
Enkrypt AI - Safety Risk19.5Risk Score87.4
HELM Safety SimpleSafetyTests100LM Evaluated Safety score (%)86
LogicKor - Multi-Turn8.35Score (0-10)85.7
LogicKor - Reasoning8.07Score (0-10)85.3
LogicKor8.26Score (0-10)84.9
LogicKor - Single-Turn8.4Score (0-10)84.9
LogicKor - Coding9.28Score (0-10)84.5

Interactive version: theaggregate.ai/model?slug=claude-3-haiku-20240307 · How It Works · Data refreshed daily, snapshot 2026-09-05.