OpenCompass LLM - Language - English (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1GPT-4 Turbo (Preview)58.6
2OrionStar-Yi-34B-Chat54.4
3Qwen-72B-Chat49.4
4Llama 2 70B Chat49.1
5Yi 34B (Chat)48.6
6Qwen-14B-Chat47.1
7Baichuan2-13B-Chat40.4
8Qwen-7B Chat39.8
9Mistral 7B Instruct (v0.2)39.4
10Llama 2 13B Chat37.4
11Yi 6B (Chat)34.6
12Baichuan2-7B-Chat33.7
13WizardLM-13B-V1.232.1
14Llama 2 7B Chat27.7
15deepseek-llm-7B-chat22

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-language-english-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.