Open Arabic LLM - Alghafa Multiple Choice Grounded Statement Soqal Task: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1Qwen 2.5 32B Instruct94.67
2Awqward2.5-32B-Instruct94.67
3Qwentile2.5-32B-Instruct94.67
4Qwen2.5-32B-Instruct-CFT94.67
5Rombos-LLM-V2.6-Qwen-14B94.67
6lambda-qwen2.5-14B-dpo-test94
7Qwen2.5-14B-Gutenberg-1e-Delta94
8recoilme-gemma-2-9B-v0.494
9Qwen 2.5 72B Instruct93.33
10Qwen 2.5 14B Instruct93.33
11Saka-14B93.33
12Qwen2.5-Lumen-14B93.33
13Gemma 3 27B (IT)92.67
14aya-expanse-32B92.67
15Qwen2.5-32B-Instruct-abliterated-v292.67

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-alghafa-multiple-choice-grounded-statement-soqal-task · How It Works · Data refreshed daily, snapshot 2026-09-05.