Chinese Classical Bench — leaderboard

Metric: Average Score (%). Source: huggingface.co. 10 models tracked.

Top models

#ModelScore
1Claude Opus 4.766.21
2Claude Opus 4.7 (Thinking)65.48
3Claude Sonnet 4.661.3
4Qwen 3.5 35B A3B59.62
5GLM-558.8
6MiniMax-M2.158.19
7DeepSeek V3.258.16
8MiniMax-M2.554.97
9Qwen3 Coder Next54.8
10Claude Haiku 4.5 (20251001)45.98

Interactive version: theaggregate.ai/benchmark?slug=chinese-classical-bench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.