OpenCompass Reasoning - Common (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)73.6
2GPT-5.2 (High)69.6
3Claude Opus 4.5 (Thinking)68.2
4Kimi K2.564.5
5DeepSeek V3.261.2
6Claude Sonnet 4.5 (Thinking)60.8
7GLM-4.760.8
8Grok 4.160.8
9Qwen 3 Max (2026-01-23)60.8
10O3 (2025-04-16) (High)59.9
11GPT-OSS-120B (High)59.7
12Tencent HY 2.0 Think59.6
13Ring-1T56.9
14Qwen 3 235B A22B 2507 (Thinking)56.1
15ERNIE 5.055.5

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-common-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.