OpenCompass Knowledge - Humanities - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1Qwen-72B-Chat59.4
2OrionStar-Yi-34B-Chat56.9
3Yi 34B (Chat)52.9
4Qwen-14B-Chat46.1
5Yi 6B (Chat)45.3
6GPT-4 Turbo (Preview)42
7Qwen-7B Chat39
8Baichuan2-13B-Chat35.5
9Baichuan2-7B-Chat34.4
10deepseek-llm-7B-chat31.2
11WizardLM-70B-V1.025.8
12WizardLM-13B-V1.220.6
13Mistral 7B Instruct (v0.2)16.8
14Llama 2 70B Chat14.6
15Llama 2 13B Chat13.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-humanities-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.