Vals AI LiveCodeBench — leaderboard

Metric: Accuracy (%). Source: www.vals.ai. 128 models tracked.

Top models

#ModelScore
1Claude Fable 589.78
2Gemini 3.1 Pro (Preview)88.48
3GPT-5.2 Codex87.99
4Claude Opus 4.887.82
5Gemini 3.5 Flash87.6
6DeepSeek V4 Pro87.48
7Grok 4.587.35
8GPT-5.3 Codex87.31
9Kimi K387.19
10Qwen 3.7 Max87.06
11Kimi K2.686.77
12GPT-5 Mini86.61
13GPT-5.186.49
14Gemini 3 Pro (Preview)86.41
15Nemotron 3 Ultra85.98

Interactive version: theaggregate.ai/benchmark?slug=vals-ai-livecodebench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.