LexGenius: leaderboard

Expert-level benchmark for legal general intelligence, covering Chinese legal understanding and reasoning across multiple task dimensions.

Metric: CoT average (self-reported). Source: benchmarklist.com. Status: saturated. 9 models tracked.

Top models

#ModelScore
1DeepSeek R164.59
2DeepSeek V364.39
3Qwen 2.5 7B59.38
4Qwen 3 8B55.3
5GPT-4.1 Nano53.43
6Qwen 3 4B53.19
7GPT-4o Mini52.61

Interactive version: theaggregate.ai/benchmark?slug=lexgenius · How It Works · Data refreshed daily, snapshot 2026-09-05.