OpenCompass Math - Middle - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 51 models tracked.

Top models

#ModelScore
1GPT-4o (2024-05-13)55.8
2Qwen 1.5 110B Chat53.4
3Qwen-72B-Chat53.4
4GLM-450.2
5Qwen 1.5 72B Chat50
6Moonshot v1 8K48.2
7Claude 3 Opus46.8
8GPT-4 Turbo (Preview)45.4
9DeepSeek V2 Chat44.6
10GPT-4 Turbo44.2
11Qwen 1.5 14B Chat44
12Llama 3 70B Instruct39.8
13Qwen-14B-Chat39.4
14Mistral Large34.2
15internlm2-chat-20B34.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-math-middle-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.