OpenCompass LLM - Average - English (CompassBench 2402): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 35 models tracked.

Top models

#ModelScore
1GPT-4 Turbo (Preview)64.6
2GLM-459.7
3Qwen Max56.3
4internlm2-chat-20B52.8
5GPT-3.5 Turbo52.5
6Qwen 1.5 72B Chat52.4
7Qwen-72B-Chat52.1
8internlm2-chat-7B49.2
9Qwen 1.5 14B Chat49
10Yi 34B (Chat)47.9
11OrionStar-Yi-34B-Chat46
12Qwen-14B-Chat45.2
13Mixtral 8x7B Instruct (v0.1)43.9
14Llama 2 70B Chat40.8
15Qwen 1.5 7B Chat39.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-average-english-compassbench-2402 · How It Works · Data refreshed daily, snapshot 2026-09-19.