OpenCompass Math - Competition (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1GPT-5.2 (High)70
2Qwen 3 Max (2026-01-23)70
3Kimi K2.569.2
4Gemini 3 Pro (Preview)69
5Kimi K2 (Thinking)66.3
6Claude Opus 4.5 (Thinking)65
7GPT-OSS-120B (High)64.5
8DeepSeek V3.264.2
9GLM-4.764
10Tencent HY 2.0 Think62.9
11Ring-1T61.8
12Grok 4.161
13Claude Sonnet 4.5 (Thinking)60.3
14Qwen 3 235B A22B 2507 (Thinking)58.7
15Qwen 3 Next 80B A3B (Thinking)58.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-math-competition-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.