OpenCompass Reasoning - Common: leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 15 models tracked.

Top models

#ModelScore
1Claude Opus 4.8 (High)80.6
2Claude Opus 5 (High)80.1
3GPT-5.5 (High)78.6
4Qwen 3.8 Max78.1
5GPT-5.6 Sol (High)77.8
6Gemini 3.7 Flash76.8
7Kimi K3 (High)76
8Grok 4.6 (High)75.3
9GLM-5.374.5
10DeepSeek V4 Flash73
11Hy3-preview (High)72.2
12MiniMax-M369.9
13DeepSeek V4 Pro69.6

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-common · How It Works · Data refreshed daily, snapshot 2026-09-05.