Open Chinese LLM - CMMLU — leaderboard
Metric: Accuracy (%). Source: huggingface.co. 338 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | Qwen 2 72B | 78.66 |
| 2 | Qwen 2 72B Instruct | 78.4 |
| 3 | Higgs-Llama-3-70B | 75.33 |
| 4 | free-evo-qwen72B-v0.8-re | 73.88 |
| 5 | TW3-JRGL-v2 | 73.73 |
| 6 | Llama 3 70B Synthia V3.5 | 73.46 |
| 7 | Rhea-72B-v0.5 | 73.31 |
| 8 | Meta-LLama-3-Cat-Smaug-LLama-70B | 72.48 |
| 9 | autotrain-llama3-70B-orpo-v1 | 72.42 |
| 10 | dolphin-2.9.1-llama-3-70B | 72.34 |
| 11 | Smaug-72B-v0.1 | 72.32 |
| 12 | Llama 3 70B Japanese Suzume Vector V0.1 | 72.14 |
| 13 | Llama3-TenyxChat-70B | 72.02 |
| 14 | Le_Triomphant-ECE-TW3 | 71.86 |
| 15 | 34B-beta | 71.71 |
Interactive version: theaggregate.ai/benchmark?slug=open-chinese-llm-cmmlu · How the rankings work · Data refreshed daily, snapshot 2026-07-22.