OpenCompass Knowledge - Social Science - Chinese (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-08-06)79
2GPT-4o (2024-11-20)78.2
3Claude 3.5 Sonnet (20241022)77.4
4Step 2 16K75.9
5GLM-4 Plus72.9
6Mistral Large 2 (Nov) Instruct (2411)69.9
7Qwen 2.5 72B Instruct69.2
8Llama 3.1 405B Instruct FP869.2
9Yi Lightning69.2
10DeepSeek V2.568.4
11Grok Beta65.4
12Llama 3.1 70B Instruct63.9
13TeleChat261.6
14360gpt2-pro60.1
15O1 Mini (2024-09-12)57.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-social-science-chinese-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.