Open Chinese LLM - ARC Challenge — leaderboard
Metric: Accuracy (%). Source: huggingface.co. 338 models tracked.
Top models
| # | Model | Score |
|---|---|---|
| 1 | free-evo-qwen72B-v0.8-re | 71.16 |
| 2 | TW3-JRGL-v2 | 71.16 |
| 3 | Rhea-72B-v0.5 | 70.99 |
| 4 | luxia-21.4B-alignment-v1.0 | 69.97 |
| 5 | MultiVerse_70B | 69.28 |
| 6 | Le_Triomphant-ECE-TW3 | 69.2 |
| 7 | Smaug-72B-v0.1 | 67.66 |
| 8 | Qwen 2 72B Instruct | 66.47 |
| 9 | UNA-SimpleSmaug-34B-v1beta | 66.04 |
| 10 | Smaug-34B-v0.1 | 65.87 |
| 11 | luxia-21.4B-alignment-v1.2 | 64.25 |
| 12 | ECE-TW3-JRGL-V5 | 64.16 |
| 13 | Yi-34Bx2-MoE-60B-DPO | 64.08 |
| 14 | Mixtral_34Bx2_MoE_60B | 63.99 |
| 15 | Qwen 2 72B | 63.74 |
Interactive version: theaggregate.ai/benchmark?slug=open-chinese-llm-arc-challenge · How the rankings work · Data refreshed daily, snapshot 2026-07-22.