CIBER (OpenInterpreter): leaderboard
Metric: Attack success rate (%) of memory-poisoning, indirect-injection, direct-injection and prompt-backdoor (mean of the four) attacks against the OpenInterpreter code-interpreter agent, natural-language inputs over CIBER's 25 RedCode-derived risk scenarios (750 tests per cell), success verified by state probes in a Docker sandbox; lower is better. Source: arxiv.org. 3 models tracked.
Top models
| # | Model | Score | Overall rank |
|---|---|---|---|
| 1 | OpenInterpreter + GPT-5-mini | 48 | |
| 2 | OpenInterpreter + GPT-3.5-Turbo | 63.2 | |
| 3 | OpenInterpreter + GPT-4o | 69.3 |
Interactive version: theaggregate.ai/benchmark?slug=ciber-openinterpreter · How It Works · Data refreshed daily, snapshot 2026-10-11.