OI-Bench - Threat Framing - Injected Accuracy: leaderboard

Metric: Accuracy (%). Source: arxiv.org. Saturation forecast: Around September 2027. 12 models tracked.

Top models

#ModelScore
1Claude Haiku 4.585.78
2Grok 4.181.26
3GPT-574.29
4Llama 4 Scout73.82
5Qwen 3 235B A22B73.72
6GPT-5 Mini71.93
7DeepSeek R171.82
8Llama 4 Maverick68.1
9DeepSeek V3.267.55
10Qwen 3 8B63.55
11Gemini 2.5 Pro55.46
12Gemini 2.5 Flash Lite48.36

Interactive version: theaggregate.ai/benchmark?slug=oi-bench-threat-framing-injected-accuracy · How It Works · Data refreshed daily, snapshot 2026-09-25.