OpenCompass Reasoning - Academic (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1GPT-5.2 (High)50.5
2Gemini 3 Pro (Preview)49.4
3Claude Opus 4.5 (Thinking)45.3
4Kimi K2.544.9
5Qwen 3 Max (2026-01-23)44.3
6O3 (2025-04-16) (High)43
7Kimi K2 (Thinking)42.9
8DeepSeek V3.241.3
9Claude Sonnet 4.5 (Thinking)40.7
10GLM-4.739.9
11GPT-OSS-120B (High)38.8
12Grok 4.137.2
13Tencent HY 2.0 Think37.1
14O4 Mini (2025-04-16) (High)34.6
15Ring-1T32.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-academic-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.