OJBench: leaderboard

Competitive-programming benchmark drawn from NOI and ICPC-style online-judge tasks, evaluating algorithm design and code correctness.

Metric: Score (%). Source: llm-stats.com. Status: saturated. 9 models tracked.

Top models

#ModelScore
1Kimi K2.660.6
2Qwen 3.5 27B40.1
3Qwen 3.5 122B A10B39.5
4Qwen 3.5 35B A3B36
5Qwen 3 235B A22B 2507 (Thinking)32.5
6Qwen 3 Next 80B A3B (Thinking)29.7
7Kimi K227.1
8Kimi K2 090527.1

Interactive version: theaggregate.ai/benchmark?slug=ojbench · How It Works · Data refreshed daily, snapshot 2026-09-05.