IslamicLegalBench - Moderate Complexity — leaderboard

Metric: Weighted Accuracy (%). Source: huggingface.co. 12 models tracked.

Top models

#ModelScore
1GPT-568.98
2Claude Sonnet 4.565.99
3Gemini 2.5 Pro63.05
4Grok 461.76
5DeepSeek R156.71
6Llama 4 Maverick Instruct FP852.17
7Qwen 3 235B A22B 2507 Instruct50.88
8GPT-OSS-120B44
9Llama 3.1 8B Instruct34.65

Interactive version: theaggregate.ai/benchmark?slug=islamiclegalbench-moderate-complexity · How the rankings work · Data refreshed daily, snapshot 2026-07-22.