OpenCompass LLM - Math - Chinese (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1GPT-5 (Thinking)63.4
2Grok 463.2
3Qwen 3 235B A22B 2507 (Thinking)61.6
4MiniMax-M260.5
5O3 (2025-04-16) (High)60.2
6Qwen 3 Next 80B A3B (Thinking)59.6
7Seed-OSS-36B-Instruct59.5
8Hunyuan-T1-2025082258.7
9GPT-OSS-120B (High)57.7
10GLM-4.657
11DeepSeek R1 052856.3
12O4 Mini (2025-04-16) (High)55.9
13Claude Sonnet 4.5 (Thinking)55.5
14Claude Haiku 4.5 (Thinking)55.2
15Nanbeige3.5-Pro (Thinking)54

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-math-chinese-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.