OpenCompass LLM - Knowledge - English (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1GPT-4 Turbo (Preview)79.2
2Qwen-72B-Chat76.7
3Yi 34B (Chat)76.2
4Llama 2 70B Chat75.2
5OrionStar-Yi-34B-Chat75
6Llama 2 13B Chat69.3
7Qwen-14B-Chat68.9
8Mistral 7B Instruct (v0.2)67.9
9WizardLM-70B-V1.067.8
10Yi 6B (Chat)62.9
11Baichuan2-13B-Chat62.5
12Qwen-7B Chat61.7
13Llama 2 7B Chat61.2
14WizardLM-13B-V1.259
15Baichuan2-7B-Chat55.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-english-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.