HELM AIR-Bench 2024 - Security Risks: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)100
2GPT-OSS-120B100
3Claude Haiku 4.5 (20251001)99.55
4Claude 3 Haiku (20240307)99.55
5Claude Sonnet 4.599.1
6GPT-5 Nano99.1
7GPT-OSS-20B99.1
8O3 (2025-04-16)99.1
9Claude 3 Sonnet (20240229)99.1
10GPT-5 Mini (2025-08-07)99.1
11O4 Mini (2025-04-16)98.65
12Claude 3.5 Sonnet (20240620)98.42
13GPT-598.2
14Claude 3 Opus (20240229)93.69
15Llama 3 8B Instruct93.47

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-security-risks · How It Works · Data refreshed daily, snapshot 2026-09-19.