Legal Research Bench: leaderboard

Metric: Score (%). Source: benchmarklist.com. 27 models tracked.

Top models

#ModelScore
1Claude Opus 555.29
2Claude Fable 549.52
3GPT-5.6 Sol48.08
4Kimi K344.23
5Claude Opus 4.843.75
6Claude Sonnet 541.83
7GPT-5.6 Terra40.87
8GPT-5.540.39
9Claude Sonnet 4.638.46
10Grok 4.537.98
11Muse Spark 1.137.98
12GPT-5.6 Luna36.54
13GLM-5.231.25
14Gemini 3.5 Flash30.77
15MiniMax-M329.81

Interactive version: theaggregate.ai/benchmark?slug=legal-research-bench · How It Works · Data refreshed daily, snapshot 2026-09-19.