OpenCompass LLM - Math - English (CompassBench 2510): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 27 models tracked.

Top models

#ModelScore
1Grok 472.7
2Qwen 3 235B A22B 2507 (Thinking)72
3MiniMax-M270.6
4GPT-OSS-120B (High)70.2
5DeepSeek R1 052869.6
6Seed-OSS-36B-Instruct69.4
7GLM-4.669
8Qwen 3 Next 80B A3B (Thinking)68
9O3 (2025-04-16) (High)67.8
10GPT-5 (Thinking)67.8
11Nanbeige3.5-Pro (Thinking)64.9
12Claude Sonnet 4.5 (Thinking)64.1
13O4 Mini (2025-04-16) (High)63.9
14Hunyuan-T1-2025082261.7
15Claude Haiku 4.5 (Thinking)60.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-math-english-compassbench-2510 · How It Works · Data refreshed daily, snapshot 2026-09-19.