OpenCompass Language - Sentiment Analysis - Chinese (CompassBench 2405): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 39 models tracked.

Top models

#ModelScore
1GPT-4 Turbo89.3
2internlm2-chat-7B89.3
3Moonshot v1 8K89
4Qwen 1.5 72B Chat88.3
5GPT-4o (2024-05-13)87.7
6Qwen 1.5 32B Chat87.7
7Claude 3 Opus87
8GLM-486.7
9chatglm3-6B86.3
10Qwen 1.5 7B Chat85.7
11Llama 3 70B Instruct84.7
12Qwen 1.5 14B Chat84.7
13DeepSeek-V2-Lite-Chat84.7
14Yi 1.5 34B Chat84
15Qwen 1.5 110B Chat84

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-sentiment-analysis-chinese-compassbench-2405 · How It Works · Data refreshed daily, snapshot 2026-09-19.