OpenCompass LLM - Reasoning - English (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Yi Large45.9
2GPT-4 Turbo45.5
3GPT-4o (2024-05-13)43.2
4Claude 3 Opus42.2
5Yi-1.5-9B Chat41.3
6Llama 3 70B Instruct39.7
7Yi 1.5 34B Chat39
8internlm2-chat-7B35
9GLM-434.3
10DeepSeek V2 Chat34
11Qwen 1.5 32B Chat33.6
12Moonshot v1 8K32.9
13Qwen 1.5 72B Chat32.7
14Mixtral 8x22B Instruct (v0.1)30.9
15Command-R+30.8

Interactive version: theaggregate.ai/benchmark?slug=opencompass-llm-reasoning-english-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.