ChineseGLUE — leaderboard

Original ChineseGLUE language-understanding benchmark for Chinese classification, sentence-pair, NER, and reading-comprehension tasks.

Metric: Classification Score (%). Source: github.com. 9 models tracked.

Top models

#ModelScore
1RoBERTa-wwm-large85.13
2RoBERTa-large85.08
3BERT-wwm-ext84.89
4ERNIE-base84.63
5BERT-base84.57
6RoBERTa-wwm-ext84.55
7ALBERT-xlarge84.08
8XLNet-mid81.07
9ALBERT-tiny78.22

Interactive version: theaggregate.ai/benchmark?slug=chineseglue · How the rankings work · Data refreshed daily, snapshot 2026-07-22.