OpenCompass Code - Competition - Chinese (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-OSS-120B (High)69.6
2O4 Mini (2025-04-16) (High)69.6
3O3 (2025-04-16) (High)68.1
4GPT-5 (Thinking)68.1
5Hunyuan-T1-2025082265.2
6Grok 462.3
7Qwen 3 235B A22B 2507 (Thinking)60.9
8DeepSeek R1 052856.5
9GLM-4.656.5
10Seed-OSS-36B-Instruct56.5
11Claude Sonnet 4.5 (Thinking)55.1
12Gemini 2.5 Pro49.3
13Qwen 3 Next 80B A3B (Thinking)49.3
14DeepSeek V3.2 Exp47.8
15Claude Haiku 4.5 (Thinking)47.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-code-competition-chinese-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.