OpenCompass Knowledge - Common Sense - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1OrionStar-Yi-34B-Chat77.6
2Qwen-72B-Chat76.5
3Yi 34B (Chat)74.9
4Yi 6B (Chat)69.4
5GPT-4 Turbo (Preview)66.7
6Qwen-14B-Chat65.6
7Qwen-7B Chat51.9
8Baichuan2-13B-Chat44.8
9deepseek-llm-7B-chat44.3
10Baichuan2-7B-Chat44.3
11WizardLM-70B-V1.032.2
12Llama 2 70B Chat24
13WizardLM-13B-V1.222.4
14Mistral 7B Instruct (v0.2)21.9
15Llama 2 13B Chat13.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-common-sense-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.