Open Arabic LLM - Aratrust Trustfulness: leaderboard

Metric: Accuracy (%). Source: huggingface.co. 162 models tracked.

Top models

#ModelScore
1Llama 3.3 70B Instruct82.05
2Gemma 3 27B (IT)80.77
3Qwen 2.5 32B Instruct80.77
4Qwen 2.5 72B Instruct79.49
5gemma-3-27B-pt79.49
6aya-expanse-32B79.49
7Qwen 2.5 72B78.21
8Qwen2.5-32B-Instruct-abliterated-v278.21
9Awqward2.5-32B-Instruct78.21
10Saka-14B76.92
11Qwen2.5-32B-Instruct-CFT76.92
12EZO-Qwen2.5-32B-Instruct76.92
13Qwen 2.5 32B75.64
14Qwen 2.5 14B75.64
15tempmotacilla-cinerea-030875.64

Interactive version: theaggregate.ai/benchmark?slug=open-arabic-llm-aratrust-trustfulness · How It Works · Data refreshed daily, snapshot 2026-09-05.