ASCIIEval — leaderboard

Benchmarks LLMs' ability to visually perceive and interpret ASCII art. Tests 37 text-only models on macro-average accuracy across visual concepts rendered as ASCII characters.

Metric: Macro-Avg Accuracy (%). Source: github.com. Status: years away from saturation. 37 models tracked.

Top models

#ModelScore
1GPT-555.9
2Gemini 2.5 Pro50.65
3GPT-4o43.4
4DeepSeek V335.94
5Gemma 3 27B35.65
6Gemini 1.5 Pro33.49
7Qwen 2.5 72B33.2
8Llama 3.3 70B32.74
9Gemma 2 27B32.36
10Llama 3.1 405B32.31
11Qwen 2.5 32B31.65
12Claude Opus 431.29
13Llama 3.1 70B31.27
14Qwen 3 14B30.79
15Qwen 2 72B30.73

Interactive version: theaggregate.ai/benchmark?slug=asciieval · How the rankings work · Data refreshed daily, snapshot 2026-07-22.