OpenCompass Language - Traditional Cultural Understanding - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1Qwen 1.5 110B Chat70.7
2Qwen 1.5 32B Chat63.7
3Qwen 1.5 72B Chat63.7
4Yi 1.5 34B Chat60.7
5GPT-4o (2024-05-13)58.3
6Qwen 1.5 14B Chat58
7DeepSeek V2 Chat58
8Yi Large54.7
9Yi-1.5-9B Chat54
10GLM-451.7
11Yi-1.5-6B-Chat49
12Qwen 1.5 7B Chat44
13Moonshot v1 8K42.3
14DeepSeek-V2-Lite-Chat38.7
15internlm2-chat-7B38.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-traditional-cultural-understanding-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.