OpenCompass Reasoning - Common Sense - English (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Llama 3 70B Instruct31.8
2Yi 1.5 34B Chat30
3GPT-4o (2024-05-13)26.9
4Yi Large26.5
5Yi-1.5-9B Chat26
6Claude 3 Opus25.1
7Qwen 1.5 32B Chat25.1
8Qwen 1.5 110B Chat25.1
9internlm2-chat-7B24.2
10Command-R+23.8
11Llama 3 8B Instruct22.9
12GLM-420.6
13DBRX20.2
14Mistral 7B Instruct (v0.3)19.7
15Mixtral 8x7B Instruct (v0.1)19.3

Interactive version: theaggregate.ai/benchmark?slug=opencompass-reasoning-common-sense-english-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.