OpenCompass Subjective - Average - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1GPT-4o (2024-05-13)66.1
2GPT-4 Turbo51.3
3GLM-450.7
4Qwen 1.5 110B Chat49.3
5Claude 3 Opus44.4
6Yi 1.5 34B Chat44.2
7DeepSeek V2 Chat44
8Moonshot v1 8K43.1
9Yi Large42.4
10internlm2-chat-20B40.6
11Yi-1.5-9B Chat37
12Qwen 1.5 72B Chat34.8
13internlm2-chat-7B33.8
14Qwen 1.5 32B Chat33.6
15Command-R+33.2

Interactive version: theaggregate.ai/benchmark?slug=opencompass-subjective-average-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.