OpenCompass Language - Sentiment Analysis - English (CompassBench 2404): leaderboard

Metric: Score (%). Source: rank.opencompass.org.cn. 31 models tracked.

Top models

#ModelScore
1GPT-4 Turbo (Preview)78
2OrionStar-Yi-34B-Chat77
3Mistral 7B Instruct (v0.2)73.3
4Qwen-14B-Chat69
5Qwen-7B Chat68.7
6Qwen-72B-Chat68.3
7Llama 2 70B Chat67
8Baichuan2-13B-Chat66
9Yi 34B (Chat)63.3
10Baichuan2-7B-Chat63.3
11Yi 6B (Chat)57
12WizardLM-13B-V1.256.7
13Llama 2 13B Chat55.7
14Llama 2 7B Chat39
15deepseek-llm-7B-chat29.7

Interactive version: theaggregate.ai/benchmark?slug=opencompass-language-sentiment-analysis-english-compassbench-2404 · How It Works · Data refreshed daily, snapshot 2026-09-19.