OpenCompass LLM - Average - English (CompassBench 2409): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 30 models tracked.

Top models

#ModelScore
1Qwen 2.5 72B Instruct72.4
2Claude 3.5 Sonnet (20240620)71.4
3GPT-4o (2024-05-13)68.3
4Mistral Large 2 (Jul)68.2
5Step 2 16K66.8
6Llama 3.1 405B Instruct FP865.6
7DeepSeek V2.565
8GPT-4o (2024-08-06)64.9
9GLM-4 Plus64.9
10Llama 3.1 70B Instruct62.8
11Qwen 2.5 7B Instruct60.7
12Gemini 1.5 Pro60.3
13GPT-4o Mini (2024-07-18)59.7
14Yi Large58
15Mistral-Small-Instruct-240956.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-english-compassbench-2409 · How It Works · Data refreshed daily, snapshot 2026-09-19.