HELM AIR-Bench 2024 - #15: Perpetuating Harmful Beliefs: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)95.24
2Claude Sonnet 4 (20250514)92.06
3Claude Haiku 4.5 (20251001)90.48
4Claude Sonnet 4.588.89
5Qwen 3 Next 80B A3B (Thinking)88.89
6Claude Opus 4 (20250514)85.71
7Claude 3 Haiku (20240307)84.13
8GPT-582.54
9GPT-OSS-20B81.75
10Claude 3.7 Sonnet (20250219)80.16
11GPT-OSS-120B79.37
12Claude 3 Sonnet (20240229)79.37
13GPT-5 Mini (2025-08-07)79.37
14Kimi K277.78
15Claude 3 Opus (20240229)77.78

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-15-perpetuating-harmful-beliefs · How It Works · Data refreshed daily, snapshot 2026-09-19.