Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1aya-expanse-32B98.67
2Qwen 2 72B96
3Qwen 3 8B94.67
4Qwen2.5-32B-Instruct-abliterated-v294.67
5Qwen3-8B-Base93.33
6recoilme-gemma-2-9B-v0.293.33
7Gemma 3 27B (IT)92
8Gemma 2 27B (IT)92
9gemma-3-27B-pt92
10aya-23-35B92
11Qwen 2.5 72B92
12free-evo-qwen72B-v0.8-re92
13T.E-8.192
14Qwen 2.5 72B Instruct90.67
15Qwen 2.5 32B Instruct90.67

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-alghafa-multiple-choice-facts-truefalse-balanced-task · How the rankings work · Data refreshed daily, snapshot 2026-07-22.