LexGenius — leaderboard

Expert-level benchmark for legal general intelligence, covering Chinese legal understanding and reasoning across multiple task dimensions.

Metric: CoT average (self-reported). Source: benchmarklist.com. Status: saturation imminent. 9 models tracked.

Top models

#ModelScore
1DeepSeek V364.39
2Qwen 2.5 7B Instruct59.38
3Qwen 3 8B55.3
4GPT-4.1 Nano53.43
5Qwen 3 4B53.19
6GPT-4o Mini52.61

Interactive version: theaggregate.ai/benchmark?slug=lexgenius · How the rankings work · Data refreshed daily, snapshot 2026-07-22.