OpenCompass Subjective - Language - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1GPT-4o (2024-05-13)58.6
2GLM-455.6
3GPT-4 Turbo53
4Qwen 1.5 110B Chat51.7
5DeepSeek V2 Chat51.4
6Qwen 1.5 72B Chat49.7
7Qwen 1.5 32B Chat49.3
8Claude 3 Opus47.2
9Moonshot v1 8K44.9
10Yi 1.5 34B Chat42.6
11Yi Large39.8
12Qwen 1.5 14B Chat39.6
13DeepSeek-V2-Lite-Chat38.5
14Command-R+36.2
15Yi-1.5-9B Chat35.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-subjective-language-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.