Open Arabic LLM - Arabic MMLU HT Jurisprudence: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1Llama 3.3 70B Instruct78.7
2Qwen 2.5 72B Instruct78.7
3gemma-3-27B-pt77.78
4Qwen 2 72B75.93
5Qwen 2.5 72B74.07
6Qwentile2.5-32B-Instruct74.07
7Gemma 3 27B (IT)73.15
8Qwen2.5-32B-Instruct-abliterated-v273.15
9Awqward2.5-32B-Instruct73.15
10Saka-14B73.15
11free-evo-qwen72B-v0.8-re73.15
12Qwen 2.5 32B Instruct72.22
13Qwen2.5-32B-Instruct-CFT72.22
14gemma-3-12B-pt70.37
15Qwen3-8B-Base70.37

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-arabic-mmlu-ht-jurisprudence · How It Works · Data refreshed daily, snapshot 2026-09-05.