ChatGLM2 6B — benchmark results

Provider: Zhipu. Released 2023-06-25. Access: Open.

Unified ELO 1208 ± 34, rank #1678 of 1776 rated models, from 89 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLMsPark - Dictator Game1111.6Elo Rating100
MMLU-by-task - Business Ethics61Accuracy (%)89
MMLU-by-task - Machine Learning43.75Accuracy (%)86.9
MMLU-by-task - High School Chemistry45.32Accuracy (%)85.6
LLMsPark - Trust Game1105.6Elo Rating84.6
MMLU-by-task - College Chemistry40Accuracy (%)73.7
MMLU-by-task - Global Facts36Accuracy (%)70
MMLU-by-task - Astronomy53.29Accuracy (%)69.6
LLMsPark - Prisoner's Dilemma1045.6Elo Rating69.2
MMLU-by-task - Formal Logic34.92Accuracy (%)69.2
MMLU-by-task - Econometrics30.7Accuracy (%)68.2
MMLU-by-task - Elementary Mathematics31.75Accuracy (%)65.6

Interactive version: theaggregate.ai/model?slug=chatglm2-6b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.