QIMMA - AraTrust: leaderboard

Metric: Accuracy (%, log-likelihood multiple choice). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1AIC-190.61
2Jais-2-70B-Chat90.23
3Qwen 3.5 397B A17B90.04
4Gemma 4 31B90.04
5gemma-3-27B-pt89.08
6Hala-9B88.89
7Qwen 2.5 72B Instruct88.51
8Fanar-1-9B-Instruct88.51
9Jais-2-8B-Chat87.55
10gemma-3-12B-pt87.36
11Yehia-7B-preview87.36
12Qwen 3.5 122B A10B86.97
13AceGPT-v2-32B-Chat86.97
14Qwen 3.5 27B86.59
15Gemma 3 12B (IT)86.21

Interactive version: theaggregate.ai/benchmark?slug=qimma-aratrust · How It Works · Data refreshed daily, snapshot 2026-09-19.