OpenCompass LLM - Average - Chinese (CompassBench 2507): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 28 models tracked.

Top models

#ModelScore
1GPT-565.1
2O3 (2025-04-16) (High)64.7
3Grok 463.8
4Qwen 3 235B A22B 2507 (Thinking)62.6
5Doubao-Seed-1.6-thinking-25071562.5
6O4 Mini (2025-04-16) (High)61.1
7DeepSeek R1 052860.8
8Gemini 2.5 Pro60.7
9GLM-4.560.1
10Hunyuan-T1-2025071159.1
11GLM 4.5 Air58
12Qwen 3 235B A22B 2507 Instruct57.7
13Claude Sonnet 4 (Thinking)56.9
14DeepSeek V3 (0324)54.5
15ERNIE-X1-Turbo-32K54.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-chinese-compassbench-2507 · How It Works · Data refreshed daily, snapshot 2026-09-19.