MIR-SafetyBench - Logical Decomposition: leaderboard

Metric: Attack Success Rate (%; lower is safer). Source: arxiv.org. Saturation forecast: Around December 2026. 19 models tracked.

Top models

#ModelScore
1GPT-5.110.43
2Gemini 3 Pro (Preview)39.23
3Gemini 2.5 Pro53.51
4Gemini 2.5 Flash64.85
5GPT-4o Mini69.39
6QVQ-72B-Preview73.92
7GPT-4o77.1
8InternVL3-78B85.49
9InternVL3-8B86.85
10GLM-4.1V-9B (Thinking)87.53
11InternVL3-38B88.44
12Qwen 2.5 VL 32B Instruct90.93

Interactive version: theaggregate.ai/benchmark?slug=mir-safetybench-logical-decomposition · How It Works · Data refreshed daily, snapshot 2026-09-25.