OpenCompass Language - Sentiment Analysis - Chinese (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1GPT-4 Turbo (Preview)88.7
2Qwen-7B Chat88
3Yi 34B (Chat)87
4OrionStar-Yi-34B-Chat86.3
5WizardLM-70B-V1.086
6Yi 6B (Chat)85
7Qwen-14B-Chat84
8Qwen-72B-Chat82.3
9Mistral 7B Instruct (v0.2)81.3
10deepseek-llm-7B-chat79.7
11Baichuan2-7B-Chat77.7
12Baichuan2-13B-Chat77.3
13WizardLM-13B-V1.265.7
14Llama 2 13B Chat58
15Llama 2 70B Chat33.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-sentiment-analysis-chinese-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.