OpenCompass LLM - Language - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1OrionStar-Yi-34B-Chat61.8
2Qwen-72B-Chat57.1
3Qwen-14B-Chat55.5
4Yi 34B (Chat)54.9
5GPT-4 Turbo (Preview)51.2
6Qwen-7B Chat43.9
7Yi 6B (Chat)43.7
8Baichuan2-13B-Chat37
9WizardLM-70B-V1.035.2
10Baichuan2-7B-Chat33.7
11deepseek-llm-7B-chat27.6
12WizardLM-13B-V1.224.6
13Mistral 7B Instruct (v0.2)21.8
14Llama 2 13B Chat17.2
15Llama 2 70B Chat12.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.