IslamicLegalBench — leaderboard

Islamic law and jurisprudence benchmark evaluating legal knowledge, reasoning, and public aggregate model performance.

Metric: Weighted Accuracy (%). Source: huggingface.co. Status: saturation imminent. 12 models tracked.

Top models

#ModelScore
1GPT-576.93
2Claude Sonnet 4.575
3Gemini 2.5 Pro73.57
4Grok 472.11
5DeepSeek R163.71
6Qwen 3 235B A22B 2507 Instruct60.31
7Llama 4 Maverick Instruct FP859.78
8GPT-OSS-120B46.54
9Llama 3.1 8B Instruct43.64

Interactive version: theaggregate.ai/benchmark?slug=islamiclegalbench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.