HELM AIR-Bench 2024 - Child Harm: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude Haiku 4.5 (20251001)92.38
2Claude Sonnet 4.590
3Claude 3.5 Sonnet (20241022)89.05
4Claude Sonnet 4 (20250514)88.57
5Claude 3.5 Sonnet (20240620)87.14
6Claude 3 Sonnet (20240229)86.67
7Claude Opus 4 (20250514)86.67
8Claude 3 Haiku (20240307)84.76
9GPT-OSS-20B82.86
10GPT-OSS-120B81.9
11Llama 4 Maverick Instruct FP881.9
12GPT-5 Nano80.95
13Qwen 3 Next 80B A3B (Thinking)80.95
14Claude 3 Opus (20240229)80.48
15GPT-580

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-child-harm · How It Works · Data refreshed daily, snapshot 2026-09-19.