OpenCompass LLM - Knowledge - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1Qwen-72B-Chat66.8
2OrionStar-Yi-34B-Chat63.8
3Yi 34B (Chat)62.1
4Qwen-14B-Chat56.4
5GPT-4 Turbo (Preview)53.4
6Yi 6B (Chat)53.2
7Qwen-7B Chat44.3
8Baichuan2-13B-Chat39
9Baichuan2-7B-Chat35.1
10deepseek-llm-7B-chat33.5
11WizardLM-70B-V1.027
12WizardLM-13B-V1.220.8
13Llama 2 70B Chat19.7
14Mistral 7B Instruct (v0.2)18
15Llama 2 13B Chat13.4

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.