IndicKLAR (Dogri): leaderboard

Metric: Accuracy (%; relaxed prefix match of the answer to 2,619 factual queries in Dogri script, machine-translated, not speaker-verified; direct 3-shot prompting with English examples, greedy decoding). Source: arxiv.org. Saturation forecast: Estimated already saturated. 9 models tracked.

Top models

#ModelScore
1Gemma 3 12B (IT)71.6
2Llama 3.1 8B Instruct56.1
3Qwen 2.5 14B Instruct50.5
4Qwen 2.5 7B Instruct48.9
5Gemma 3 4B (IT)48.6
6Llama 3.2 3B Instruct42.6
7Gemma 3 1B (IT)24.6
8Llama 3.2 1B Instruct23.8
9Qwen 2.5 1.5B Instruct23

Interactive version: theaggregate.ai/benchmark?slug=indicklar-dogri · How It Works · Data refreshed daily, snapshot 2026-09-26.