APEX v1 Big Law — leaderboard

Metric: Score (%). Source: www.mercor.com. 19 models tracked.

Top models

#ModelScore
1GPT-5 (High)76.6
2Claude Opus 4.6 (High)76.4
3Claude Opus 4.6 (Max)76.2
4GPT-5.4 (High)74.3
5O3 (High)73.6
6GPT-5 Codex (High)73.5
7GPT-5.2 (High)73.4
8GPT-5.1 Codex (High)73.2
9GPT-5.2 Codex (High)73
10Claude Sonnet 4.6 (High)72.3
11Claude Opus 4.5 (High)70.1
12Grok 4.1 Fast70
13GPT-5.3 Codex (High)69.8
14Gemini 3.1 Pro (Preview) (High)67.6
15Grok 467

Interactive version: theaggregate.ai/benchmark?slug=apex-v1-big-law · How the rankings work · Data refreshed daily, snapshot 2026-07-22.