Open Arabic LLM - Arabic MMLU HT Machine Learning: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1Qwen 2.5 72B Instruct56.25
2Qwentile2.5-32B-Instruct56.25
3Qwen 2.5 72B53.57
4Qwen 2 72B53.57
5Awqward2.5-32B-Instruct52.68
6Llama 3.3 70B Instruct50.89
7Qwen2.5-32B-Instruct-CFT50.89
8Qwen 2.5 32B Instruct50
9Qwen 2.5 32B49.11
10Rombos-LLM-V2.6-Qwen-14B49.11
11Qwen3-8B-Base48.21
12Qwen2.5-32B-Instruct-abliterated-v248.21
13Gemma 3 27B (IT)46.43
14Saka-14B45.54
15Qwen 2.5 14B Instruct44.64

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-arabic-mmlu-ht-machine-learning · How It Works · Data refreshed daily, snapshot 2026-09-05.