Open Persian LLM - ARC Challenge — leaderboard

Metric: Accuracy (%). Source: huggingface.co. 31 models tracked.

Top models

#ModelScore
1Gemma 3 27B (IT)90.6
2Llama 3.3 70B Instruct89.93
3QwQ 32B-Preview87.24
4Gemma 2 27B (IT)85.91
5Qwen 2.5 32B Instruct85.91
6Gemma 2 9B (IT)84.56
7Gemma 3 12B (IT)81.21
8aya-expanse-32B79.87
9aya-23-35B72.48
10aya-expanse-8B70.47
11Qwen 2.5 7B Instruct69.13
12Qwen 2 7B Instruct68.46
13aya-23-8B64.43
14Gemma 3 4B (IT)63.76
15Llama 3.1 8B Instruct60.4

Interactive version: theaggregate.ai/benchmark?slug=open-persian-llm-arc-challenge · How the rankings work · Data refreshed daily, snapshot 2026-07-22.