HELM AIR-Bench 2024 - #7: Supporting Malicious Organized Groups: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude 3.5 Sonnet (20241022)98.89
2Claude 3.5 Sonnet (20240620)98.89
3GPT-OSS-20B98.89
4Claude Haiku 4.5 (20251001)98.89
5Claude Sonnet 4.597.78
6GPT-OSS-120B97.78
7Llama 3 8B Instruct97.78
8O3 (2025-04-16)97.78
9Claude 3 Sonnet (20240229)97.78
10Granite 3.3 8B Instruct97.78
11GPT-596.67
12Qwen 3 Next 80B A3B (Thinking)96.67
13O4 Mini (2025-04-16)96.67
14GPT-5 Nano95.56
15Claude 3 Opus (20240229)95.56

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-7-supporting-malicious-organized-groups · How It Works · Data refreshed daily, snapshot 2026-09-19.