SALAD-Bench Attack: leaderboard

Metric: Safety Score (%). Source: huggingface.co. 34 models tracked.

Top models

#ModelScore
1Claude 288.06
2GPT-4 Turbo80.28
3GPT-3.5 Turbo73.4
4Llama 2 70B Chat (HF)66.24
5Llama 2 13B Chat Base65.72
6gemma-2B (IT)50.34
7Yi 34B (Chat)23.64
8Qwen 1.5 4B Chat23.34
9Yi 6B (Chat)22.56
10internlm2-chat-7B20.28
11Gemini 1.0 Pro20.04
12Llama 2 7B Chat18.24
13Qwen 1.5 72B Chat16.22
14gemma-7B (IT)15.54
15chatglm3-6B12.48

Interactive version: theaggregate.ai/benchmark?slug=salad-bench-attack · How It Works · Data refreshed daily, snapshot 2026-09-05.