OpenCompass Language - Chinese Semantic Understanding - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Qwen 1.5 32B Chat76.7
2GPT-4o (2024-05-13)76
3Qwen 1.5 72B Chat72.7
4Qwen 1.5 110B Chat70.7
5Qwen 1.5 14B Chat70.3
6Llama 3 70B Instruct66
7GLM-460
8GPT-4 Turbo58.3
9Yi 1.5 34B Chat58
10Command-R+54.3
11Yi Large52.3
12Mistral Large51.7
13Yi-1.5-9B Chat50.7
14Qwen 1.5 7B Chat44.3
15Claude 3 Opus44

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-chinese-semantic-understanding-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.