OpenCompass LLM - Average - Chinese (CompassBench 2504): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 28 models tracked.

Top models

#ModelScore
1Gemini 2.5 Pro (Preview 05-06)75.1
2DeepSeek R174.6
3Doubao-1.5-thinking-pro-25041574.3
4Qwen 3 235B A22B (Thinking)73.9
5Qwen 3 32B (Thinking)72.8
6ERNIE-X1-Turbo-32K72.8
7O4 Mini (High)71.2
8DeepSeek V3 (0324)69.8
9O3 Mini (High)68.7
10Grok 367.7
11Qwen 3 235B A22B63.7
12GPT-4.1 (2025-04-14)63.1
13Claude 3.7 Sonnet (Thinking)61.6
14GLM-4 32B (0414)61.5
15GPT-4.1 Mini60.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-chinese-compassbench-2504 · How It Works · Data refreshed daily, snapshot 2026-09-19.