OpenCompass Knowledge - Humanities - Chinese (CompassBench 2501): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 40 models tracked.

Top models

#ModelScore
1Gemini 2.0 Pro (Preview 02-05)96
2O1 (2024-12-17)92
3Mistral Large 2 (Nov) Instruct (2411)92
4Qwen 2.5 Max91
5Claude 3.5 Sonnet (20241022)89
6GLM-4 Plus88
7GPT-4o (2024-11-20)87
8DeepSeek V386
9Llama 3.1 405B Instruct FP886
10Yi Lightning86
11DeepSeek R185
12Gemini 2.0 Flash (001)85
13Qwen 2.5 72B Instruct84
14Doubao-1.5-pro-32k-25011582
15GPT-4o Mini (2024-07-18)81

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-humanities-chinese-compassbench-2501 · How It Works · Data refreshed daily, snapshot 2026-09-19.