QIMMA - Overall: leaderboard

Metric: Mean score across 14 benchmarks (%). Source: huggingface.co. 83 models tracked.

Top models

#ModelScore
1Qwen 3.5 397B A17B69.24
2Qwen 2.5 72B Instruct68.49
3AIC-167.85
4Jais-2-70B-Chat67.77
5Llama 3.3 70B Instruct67.09
6Qwen 3.5 122B A10B66.33
7Qwen 2.5 32B Instruct66.09
8Gemma 3 27B (IT)63.84
9AceGPT-v2-32B-Chat62.96
10Gemma 3 12B (IT)62.65
11Qwen 3.5 27B62.01
12Qwen 3.5 35B A3B61.16
13Fanar-2-27B-Instruct60.64
14Gemma 4 31B (IT)60.38
15Jais-2-8B-Chat59.33

Interactive version: theaggregate.ai/benchmark?slug=qimma-overall · How It Works · Data refreshed daily, snapshot 2026-09-19.