OpenCompass LLM - Knowledge - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-11-20)72.5
2Step 2 16K72.3
3GPT-4o (2024-08-06)72
4Claude 3.5 Sonnet (20241022)71.6
5Qwen 2.5 72B Instruct68.8
6GLM-4 Plus68.8
7Llama 3.1 405B Instruct FP868
8Yi Lightning67.3
9Mistral Large 2 (Nov) Instruct (2411)66.7
10Llama 3.1 70B Instruct64.1
11DeepSeek V2.563.3
12TeleChat261.6
13360gpt2-pro61.2
14O1 Mini (2024-09-12)58.5
15Gemma 2 27B (IT)52.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-knowledge-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.