OpenCompass Math - Reasoning Computation - Chinese (CompassBench 2507): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 21 models tracked.

Top models

#ModelScore
1GPT-566.2
2Doubao-Seed-1.6-thinking-25071564.4
3Grok 463.1
4GLM 4.5 Air60.6
5GLM-4.559.4
6Hunyuan-T1-2025071159.4
7Claude Sonnet 4 (Thinking)57.5
8Qwen 3 235B A22B 2507 Instruct56.9
9MiniMax M1 80k53.8
10ERNIE-X1-Turbo-32K53.1
11Gemini 2.5 Pro50.6
12Kimi K248.1
13DeepSeek V3 (0324)46.9
14GPT-4.1 (2025-04-14)26.9
15MiniMax-Text-0110

Interactive version: theaggregate.ai/benchmark?slug=opencompass-math-reasoning-computation-chinese-compassbench-2507 · How It Works · Data refreshed daily, snapshot 2026-09-19.