ActBench - OpenClaw - Malicious Attack Grading Score: leaderboard

Metric: Mean attack grading score on malicious cases (0-1; lower is safer). Source: arxiv.org. 15 models tracked.

Top models

#ModelScore
1Claude Opus 4.80.28
2Claude Sonnet 4.60.35
3MiniMax-M30.4
4Kimi K30.49
5GPT-5.50.49
6Qwen 3.7 Max0.51
7Qwen 3.7 Plus0.52
8GLM-5.20.55
9GPT-5.4 Mini0.73
10Kimi K2.60.75
11MiniMax-M2.70.8
12Grok 4.50.87
13DeepSeek V4 Flash0.89
14DeepSeek V4 Pro0.96

Interactive version: theaggregate.ai/benchmark?slug=actbench-openclaw-malicious-attack-grading-score · How It Works · Data refreshed daily, snapshot 2026-09-19.