OpenCompass Knowledge - Common Sense - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Qwen 1.5 72B Chat78.7
2GPT-4o (2024-05-13)77
3Qwen 1.5 110B Chat76.5
4Yi 1.5 34B Chat76
5Qwen 1.5 32B Chat75.4
6Yi Large74.9
7GLM-474.9
8Qwen 1.5 14B Chat73.2
9GPT-4 Turbo72.1
10Moonshot v1 8K66.1
11Yi-1.5-9B Chat66.1
12DeepSeek V2 Chat65
13Llama 3 70B Instruct64.5
14Claude 3 Opus63.9
15internlm2-chat-20B59.6

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-common-sense-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.