OpenCompass Knowledge - Social Science - English (CompassBench 2411): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 34 models tracked.

Top models

#ModelScore
1GPT-4o (2024-08-06)89.2
2Claude 3.5 Sonnet (20241022)87.8
3GPT-4o (2024-11-20)86.3
4Mistral Large 2 (Nov) Instruct (2411)84.9
5GLM-4 Plus84.2
6Grok Beta84.2
7Llama 3.1 405B Instruct FP883.5
8Step 2 16K82.7
9Yi Lightning80.6
10Llama 3.1 70B Instruct79.1
11Qwen 2.5 72B Instruct77.7
12DeepSeek V2.577
13Mistral-Small-Instruct-240974.8
14TeleChat274.8
15Llama 3.1 8B Instruct71.9

Interactive version: theaggregate.ai/benchmark?slug=opencompass-knowledge-social-science-english-compassbench-2411 · How It Works · Data refreshed daily, snapshot 2026-09-19.