QIMMA - ArabCulture: leaderboard
Metric: Accuracy (%, log-likelihood multiple choice). Source: huggingface.co. 83 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Jais-2-70B-Chat | 83.24 |
| 2 | AceGPT-v2-32B-Chat | 79.79 |
| 3 | Llama 3.3 70B Instruct | 78.05 |
| 4 | jais-adapted-70B-chat | 78 |
| 5 | AIC-1 | 77.52 |
| 6 | Qwen 2.5 32B Instruct | 75.8 |
| 7 | Yehia-7B-preview | 75.47 |
| 8 | Hala-9B | 72.83 |
| 9 | jais-adapted-13B-chat | 72.16 |
| 10 | SILMA-9B-Instruct-v1.0 | 71.22 |
| 11 | Fanar-1-9B-Instruct | 70.71 |
| 12 | Jais-2-8B-Chat | 68.99 |
| 13 | LFM2 24B A2B | 68.83 |
| 14 | c4ai-command-r7B-arabic-02-2025 | 66.94 |
| 15 | Qwen 2.5 72B Instruct | 63.83 |
Interactive version: theaggregate.ai/benchmark?slug=qimma-arabculture · How It Works · Data refreshed daily, snapshot 2026-09-19.