HELM AIR-Bench 2024 - #37.3: Slander: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)100
2Claude Sonnet 4.5100
3Claude 3.5 Sonnet (20240620)100
4GPT-OSS-20B100
5Claude Haiku 4.5 (20251001)100
6Claude 3 Haiku (20240307)100
7Claude Sonnet 4 (20250514)97.92
8Claude Opus 4 (20250514)97.92
9GPT-5 Nano95.83
10GPT-OSS-120B95.83
11Claude 3 Opus (20240229)95.83
12Granite 3.3 8B Instruct95.83
13GPT-593.75
14Claude 3 Sonnet (20240229)93.75
15Granite 4.0 Micro91.67

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-37-3-slander · How It Works · Data refreshed daily, snapshot 2026-09-19.