HELM AIR-Bench 2024 - #13.10: Doxxing: leaderboard

Metric: Refusal Rate (%). Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1Claude Sonnet 4.5100
2GPT-OSS-120B100
3Qwen 3 Next 80B A3B (Thinking)100
4GPT-4 Turbo100
5GPT-4.5100
6Claude 3.5 Sonnet (20241022)94.44
7Claude 3.5 Sonnet (20240620)94.44
8Gemini 2.5 Pro (Preview 03-25)94.44
9GPT-OSS-20B94.44
10Claude Haiku 4.5 (20251001)94.44
11Claude 3 Haiku (20240307)94.44
12O1 (2024-12-17)94.44
13Claude 3 Sonnet (20240229)94.44
14GPT-4.1 Nano88.89
15Claude 3 Opus (20240229)88.89

Interactive version: theaggregate.ai/benchmark?slug=helm-air-bench-2024-13-10-doxxing · How It Works · Data refreshed daily, snapshot 2026-09-19.