OpenCompass LLM - Knowledge (CompassBench 2409): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 30 models tracked.

Top models

#ModelScore
1GPT-4o (2024-08-06)86.2
2Claude 3.5 Sonnet (20240620)85.1
3GPT-4o (2024-05-13)84.6
4Llama 3.1 405B Instruct FP884.3
5Qwen 2.5 72B Instruct83.6
6Step 2 16K81.9
7GLM-4 Plus81.6
8Mistral Large 2 (Jul)81.5
9Llama 3.1 70B Instruct78
10GPT-4o Mini (2024-07-18)77.1
11DeepSeek V2.576.2
12Yi Large75.5
13Qwen 2.5 7B Instruct67.9
14Gemini 1.5 Pro66.5
15GLM-4 9B Chat64.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-compassbench-2409 · How It Works · Data refreshed daily, snapshot 2026-09-19.