LLM Stats (CodeForces) — leaderboard

Metric: Score. Source: llm-stats.com. 16 models tracked.

Top models

#ModelScore
1DeepSeek V4 Pro (Max)100
2DeepSeek V4 Flash (Max)100
3DeepSeek V3.2 Speciale90
4Qwen 3.5 122B A10B85.1
5Qwen 3.5 35B A3B82.2
6GPT-OSS-120B82.1
7Qwen 3.5 27B80.7
8DeepSeek V3.279.5
9DeepSeek V3.2 (Thinking)79.5
10GPT-OSS-20B74.33
11DeepSeek V3.2 Exp70.7
12DeepSeek V3.169.7
13Qwen 3 32B65.9
14DeepSeek R1 052864.33
15Gemma 4 12B55.3

Interactive version: theaggregate.ai/benchmark?slug=llm-stats-codeforces · How the rankings work · Data refreshed daily, snapshot 2026-07-22.