ERR-EVAL - Garbled Input: leaderboard

Metric: Track score. Source: err-eval.gustycube.com. 60 models tracked.

Top models

#ModelScore
1GPT-5.2 Pro7.8
2GPT-5.47.2
3GPT-5.27
4Claude Opus 4.67
5Claude Sonnet 4.66.6
6Claude Sonnet 4.56.6
7GPT-56.4
8GPT-5.16.4
9GPT-5.4 Mini6.4
10Claude Opus 46.4
11GPT-5.3 Codex6.4
12GPT-5 Mini6.2
13MiniMax-M2.76.2
14Claude Opus 4.56.2
15O36.2

Interactive version: theaggregate.ai/benchmark?slug=err-eval-garbled-input · How It Works · Data refreshed daily, snapshot 2026-09-19.