OpenCompass LLM - Knowledge - English (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-08-06)85.5
2GPT-4o (2024-11-20)85
3Claude 3.5 Sonnet (20241022)84.3
4Step 2 16K83.5
5Llama 3.1 405B Instruct FP881.8
6GLM-4 Plus81
7Mistral Large 2 (Nov) Instruct (2411)79.8
8Yi Lightning79.1
9Llama 3.1 70B Instruct78.9
10Qwen 2.5 72B Instruct78.2
11Grok Beta77.4
12DeepSeek V2.575
13TeleChat274
14O1 Mini (2024-09-12)71.8
15360gpt2-pro69.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-english-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.