Open Arabic LLM - Alghafa Multiple Choice Sentiment Task: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1Qwen 2.5 72B43.66
2Qwen 2.5 72B Instruct43.02
3Saka-14B43.02
4Qwen 2 72B43.02
5SeaLLMs-v3-7B-Chat42.44
6Gemma 3 27B (IT)42.33
7Qwen 2.5 14B42.27
8Qwen 2.5 32B41.63
9aya-expanse-32B41.57
10Llama 3.1 8B Instruct41.51
11Gemma 2 27B (IT)41.51
12SauerkrautLM-Nemo-12B-Instruct41.22
13Llama 3.3 70B Instruct41.05
14recoilme-gemma-2-9B-v0.240.99
15Qwen 2 7B Instruct40.93

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-alghafa-multiple-choice-sentiment-task · How It Works · Data refreshed daily, snapshot 2026-09-05.