OpenCompass Reasoning - Academic - Chinese (CompassBench 2507): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 28 models tracked.

Top models

#ModelScore
1O3 (2025-04-16) (High)40
2GPT-531.7
3Grok 431.7
4Gemini 2.5 Pro30.8
5Doubao-Seed-1.6-thinking-25071525.8
6O4 Mini (2025-04-16) (High)24.2
7DeepSeek R1 052821.7
8GLM-4.520.8
9Qwen 3 235B A22B 2507 (Thinking)19.2
10Claude Sonnet 4 (Thinking)16.7
11Kimi K215.8
12GLM 4.5 Air14.2
13Hunyuan-T1-2025071113.3
14ERNIE-X1-Turbo-32K12.5
15Hunyuan A13B-Instruct11.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-academic-chinese-compassbench-2507 · How It Works · Data refreshed daily, snapshot 2026-09-19.