OpenCompass Code - Competition - English (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-OSS-120B (High)75.4
2O4 Mini (2025-04-16) (High)73.9
3GPT-5 (Thinking)72.5
4O3 (2025-04-16) (High)71
5GLM-4.665.2
6Qwen 3 235B A22B 2507 (Thinking)62.3
7DeepSeek R1 052860.9
8Gemini 2.5 Pro58
9Hunyuan-T1-2025082258
10Seed-OSS-36B-Instruct55.1
11Claude Haiku 4.5 (Thinking)53.6
12Grok 452.2
13Claude Sonnet 4.5 (Thinking)52.2
14Qwen 3 Next 80B A3B (Thinking)49.3
15Hunyuan A13B-Instruct46.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-code-competition-english-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.