OpenCompass LLM - Math (CompassBench 2601): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 26 models tracked.

Top models

#ModelScore
1Qwen 3 Max (2026-01-23)73.2
2Kimi K2.572.9
3Gemini 3 Pro (Preview)71.8
4GPT-5.2 (High)71.4
5Kimi K2 (Thinking)70.3
6GLM-4.769.7
7Tencent HY 2.0 Think69.4
8Claude Opus 4.5 (Thinking)69.2
9DeepSeek V3.268.7
10Ring-1T68.3
11GPT-OSS-120B (High)68.1
12Claude Sonnet 4.5 (Thinking)68
13Qwen 3 235B A22B 2507 (Thinking)67.1
14Qwen 3 Next 80B A3B (Thinking)65.9
15O3 (2025-04-16) (High)64.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-math-compassbench-2601 · How It Works · Data refreshed daily, snapshot 2026-09-19.