OpenCompass Math - Reasoning Computation - English (CompassBench 2507): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 19 models tracked.

Top models

#ModelScore
1GPT-586.2
2GLM-4.582.5
3Doubao-Seed-1.6-thinking-25071580.6
4GLM 4.5 Air80
5MiniMax M1 80k76.9
6Qwen 3 235B A22B 2507 Instruct72.5
7Claude Sonnet 4 (Thinking)72.5
8Hunyuan-T1-2025071172.5
9ERNIE-X1-Turbo-32K65
10DeepSeek V3 (0324)63.1
11Kimi K261.9
12GPT-4.1 (2025-04-14)43.8
13MiniMax-Text-0113.1

Interactive version: theaggregate.ai/benchmark?slug=opencompass-math-reasoning-computation-english-compassbench-2507 · How It Works · Data refreshed daily, snapshot 2026-09-19.