MindBench - Safety Miss Rate: leaderboard

Metric: Harmful replies rated acceptable (%, lower is better). Source: mindbench.ai. 18 models tracked.

Top models

#ModelScore
1Claude Sonnet 4.60
2GPT-5.40
3Claude Opus 4.70
4Claude Haiku 4.5 (20251001)0
5Gemini 3.5 Flash0
6Claude Fable 50
7Gemini 2.5 Pro0.47
8Gemini 2.5 Flash0.47
9GPT-5.50.47
10DeepSeek V4 Pro0.47
11DeepSeek V4 Flash0.47
12Sonar0.94
13O31.41
14Grok 4.31.41
15Mistral Small 41.88

Interactive version: theaggregate.ai/benchmark?slug=mindbench-safety-miss-rate · How It Works · Data refreshed daily, snapshot 2026-09-19.