HELM Safety HarmBench — leaderboard

Metric: LM Evaluated Safety score (%). Source: storage.googleapis.com. 87 models tracked.

Top models

#ModelScore
1GPT-OSS-120B100
2GPT-OSS-20B98.7
3GPT-5 Nano98.4
4O3 (2025-04-16)98.4
5Claude 3.5 Sonnet (20240620)98.1
6GPT-597.6
7GPT-5.197.6
8Kimi K297.4
9Claude 3 Opus (20240229)97.4
10GPT-5 Mini97.1
11O4 Mini (2025-04-16)97
12O1 (2024-12-17)96.3
13Claude Haiku 4.5 (20251001)95.9
14Claude 3 Sonnet (20240229)95.8
15GPT-4.5 (Preview)95.8

Interactive version: theaggregate.ai/benchmark?slug=helm-safety-harmbench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.