OpenCompass LLM - Language (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1OrionStar-Yi-34B-Chat58.1
2GPT-4 Turbo (Preview)54.9
3Qwen-72B-Chat53.2
4Yi 34B (Chat)51.8
5Qwen-14B-Chat51.3
6Qwen-7B Chat41.8
7Yi 6B (Chat)39.2
8Baichuan2-13B-Chat38.7
9Baichuan2-7B-Chat33.7
10Llama 2 70B Chat31
11Mistral 7B Instruct (v0.2)30.6
12WizardLM-13B-V1.228.4
13WizardLM-70B-V1.027.5
14Llama 2 13B Chat27.3
15deepseek-llm-7B-chat24.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.