chatglm3-6B — benchmark results

Provider: Zhipu. Released 2023-10-25. Access: Open.

Unified ELO 1304 ± 15, rank #1524 of 1776 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SALAD-Bench Attack12.48Safety Score (%)51.5
T-Eval51.4Overall Score (%)50
Open Chinese LLM - C-Eval Semantic68.8Accuracy (%)46.9
SALAD-Bench51.47Average Safety Score (%)42.4
SALAD-Bench Base90.45Safety Score (%)42.4
Open Chinese LLM - TruthfulQA MC52.64Accuracy (%)39.2
InfiBench28.23Score (%)27.6
Open PL LLM - Multiple Choice0.18Average Multiple-Choice Score (%)21
Open PL LLM Leaderboard2.76Average Score (%)17.8
Open Chinese LLM - CMMLU46.11Accuracy (%)15.7
Open PL LLM - Generative4.74Average Generative Score (%)15.4
Open Chinese LLM Leaderboard47.86Average Score (%)12.8

Interactive version: theaggregate.ai/model?slug=chatglm3-6b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.