AA LiveCodeBench: leaderboard

Artificial Analysis independent evaluation of LiveCodeBench: contamination-free coding from LeetCode, AtCoder, and CodeForces problems.

Metric: Pass@1 (%). Source: artificialanalysis.ai. Status: saturation imminent. 181 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview) (High)91.75
2GLM-4.7 (Reasoning)89.42
3GPT-OSS-120B (High)87.83
4Claude Opus 4.5 (Thinking)87.09
5GPT-5.1 (High)86.77
6MiMo-V2-Flash (Reasoning)86.77
7Kimi K2 (Thinking)85.29
8GPT-5 (High)84.55
9GPT-5 Codex (High)84.02
10GPT-5 Mini (High)83.81
11Grok 4 Fast (Reasoning)83.17
12MiniMax-M282.65
13Grok 4.1 Fast (Reasoning)82.22
14Grok 481.9
15MiniMax-M2.180.95

Interactive version: theaggregate.ai/benchmark?slug=aa-livecodebench · How It Works · Data refreshed daily, snapshot 2026-09-05.