Vals AI CaseLaw v2 — leaderboard

Metric: Accuracy (%). Source: www.vals.ai. 54 models tracked.

Top models

#ModelScore
1Grok 4.379.31
2GPT-5.173.42
3GPT-5.1 (High)73.42
4GPT-4.169.88
5GPT-5 Mini68.49
6GPT-5 Mini (High)68.49
7Claude Opus 4.768.38
8GPT-566.45
9GPT-5 (High)66.45
10GPT-5.566.24
11GPT-5.5 (xHigh)66.24
12GPT-5.266.02
13GPT-5.2 (xHigh)66.02
14Grok 465.81
15Kimi K2 (Thinking)65.7

Interactive version: theaggregate.ai/benchmark?slug=vals-ai-caselaw-v2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.