OpenCompass LLM - Average - English (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 51 models tracked.

Top models

#ModelScore
1Claude 3 Opus65.3
2GPT-4 Turbo64.7
3GPT-4 Turbo (Preview)64.4
4GPT-4o (2024-05-13)64.3
5Llama 3 70B Instruct61
6DeepSeek V2 Chat58.2
7Mistral Large57.5
8GLM-457.5
9Qwen 1.5 110B Chat56.7
10Moonshot v1 8K55.1
11Qwen 1.5 72B Chat54.8
12internlm2-chat-20B52.3
13GPT-3.5 Turbo52
14Qwen-72B-Chat51.2
15DBRX50.6

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-english-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.