OpenCompass LLM - Knowledge - English (CompassBench 2409): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 30 models tracked.

Top models

#ModelScore
1GPT-4o (2024-05-13)92.8
2Claude 3.5 Sonnet (20240620)92.3
3GPT-4o (2024-08-06)91.4
4Step 2 16K90.5
5Llama 3.1 405B Instruct FP889.8
6Qwen 2.5 72B Instruct88.7
7Mistral Large 2 (Jul)88.1
8GLM-4 Plus87.5
9Llama 3.1 70B Instruct87.1
10GPT-4o Mini (2024-07-18)86.8
11Yi Large81.5
12DeepSeek V2.579.1
13Gemma 2 9B (IT)76
14Qwen 2.5 7B Instruct74
15Mistral-Small-Instruct-240973.5

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-english-compassbench-2409 · How It Works · Data refreshed daily, snapshot 2026-09-19.