SAHARA - Sentiment Analysis: leaderboard

Metric: Macro-F1 (%). Source: huggingface.co. 47 models tracked.

Top models

#ModelScore
1GPT-4.157.52
2Gemini 3 Pro (Preview)55.68
3Claude Sonnet 4 (20250514)55.67
4Gemini 2.5 Pro53.01
5Gemini 2.5 Flash52.07
6GPT-5.151.56
7GPT-551.02
8GPT-5.6 Luna48.66
9Qwen 3.5 27B47.91
10c4ai-command-a-03-202547.14
11Qwen 3.6 27B46.58
12Gemma 3 27B (IT)46.35
13Llama 3.3 70B Instruct45.82
14Llama 4 Scout Instruct45.12
15Qwen 3.6 35B A3B44.68

Interactive version: theaggregate.ai/benchmark?slug=sahara-sentiment-analysis · How It Works · Data refreshed daily, snapshot 2026-09-19.