OpenCompass Knowledge - Social Science - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1Qwen-72B-Chat73.1
2Yi 34B (Chat)69.8
3OrionStar-Yi-34B-Chat68.8
4Qwen-14B-Chat64.6
5Yi 6B (Chat)58.6
6GPT-4 Turbo (Preview)56.6
7Qwen-7B Chat48.4
8Baichuan2-13B-Chat45.5
9Baichuan2-7B-Chat33.2
10deepseek-llm-7B-chat32.8
11WizardLM-70B-V1.028.6
12Llama 2 70B Chat23.9
13WizardLM-13B-V1.221.9
14Mistral 7B Instruct (v0.2)16.7
15Llama 2 13B Chat14.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-social-science-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.