Open Arabic LLM - Arabic MMLU HT Philosophy — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 163 models tracked.

Top models

#ModelScore
1calme-2.1-qwen2.5-72B76.85
2calme-2.2-qwen2.5-72B76.53
3Rombos-LLM-V2.5-Qwen-72B76.21
4Ultiima-72B76.21
5Qwen 2.5 72B Instruct74.28
6gemma-3-27B-pt71.06
7Qwen2.5-32B-Instruct-abliterated-v270.74
8Llama 3.3 70B Instruct69.13
9Awqward2.5-32B-Instruct68.81
10lambda-qwen2.5-32B-dpo-test68.81
11gemma-3-12B-pt68.49
12Qwen 2.5 32B Instruct67.52
13Qwen2.5-32B-Instruct-CFT67.52
14Qwen 2 72B67.2
15Gemma 3 27B (IT)66.88

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-arabic-mmlu-ht-philosophy · How the rankings work · Data refreshed daily, snapshot 2026-07-22.