HELM Safety - Harm Bench: leaderboard

Metric: LM Evaluated Safety score. Source: crfm.stanford.edu. 87 models tracked.

Top models

#ModelScore
1GPT-OSS-120B100
2GPT-OSS-20B98.7
3GPT-5 Nano98.44
4O3 (2025-04-16)98.4
5Claude 3.5 Sonnet (20240620)98.1
6Claude Sonnet 4 (2025-05-14) (Thinking)98
7GPT-597.62
8GPT-5.197.6
9Claude 3 Opus (20240229)97.44
10Kimi K297.4
11GPT-5 Mini97.1
12GPT-5 Mini (2025-08-07)97.06
13O4 Mini (2025-04-16)97
14O1 (2024-12-17)96.31
15Claude Haiku 4.5 (20251001)95.9

Interactive version: theaggregate.ai/benchmark?slug=helm-safety-harm-bench · How It Works · Data refreshed daily, snapshot 2026-09-08.