OpenCompass Language - Intention Recognition - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1OrionStar-Yi-34B-Chat70.3
2Qwen-72B-Chat65.7
3Qwen-14B-Chat65.3
4Yi 34B (Chat)63
5Yi 6B (Chat)41.3
6Qwen-7B Chat41.3
7GPT-4 Turbo (Preview)39.7
8Baichuan2-7B-Chat29.7
9Baichuan2-13B-Chat28.7
10WizardLM-70B-V1.021.3
11WizardLM-13B-V1.29
12Mistral 7B Instruct (v0.2)8.3
13Llama 2 70B Chat8.3
14Llama 2 13B Chat7
15deepseek-llm-7B-chat4.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-intention-recognition-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.