MIR-SafetyBench - Semantic Complementarity: leaderboard

Metric: Attack Success Rate (%; lower is safer). Source: arxiv.org. Saturation forecast: Around December 2026. 19 models tracked.

Top models

#ModelScore
1GPT-5.18.57
2Gemini 3 Pro (Preview)32.5
3Gemini 2.5 Pro38.21
4GPT-4o Mini49.64
5Gemini 2.5 Flash60.71
6GPT-4o61.79
7InternVL3-78B65.71
8QVQ-72B-Preview74.29
9InternVL3-8B74.64
10InternVL3-38B83.93
11Qwen 2.5 VL 32B Instruct88.57
12GLM-4.1V-9B (Thinking)88.93

Interactive version: theaggregate.ai/benchmark?slug=mir-safetybench-semantic-complementarity · How It Works · Data refreshed daily, snapshot 2026-09-25.