chatglm3-6B: benchmark results

Provider: Zhipu. Released 2023-10-25. Access: Open.

Unified ELO 1349 ± 1, rank #1270 of 1392 rated models, from 28 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SALAD-Bench Attack12.48Safety Score (%)51.5
T-Eval51.4Overall Score (%)50
Open Chinese LLM - C-Eval Semantic68.8Accuracy (%)46.9
SALAD-Bench51.47Average Safety Score (%)42.4
SALAD-Bench Base90.45Safety Score (%)42.4
Open Chinese LLM - TruthfulQA MC52.64Accuracy (%)39.2
InfiBench28.23Score (%)27.6
Open PL LLM - Multiple Choice0.18Average Multiple-Choice Score (%)21
Open PL LLM Leaderboard2.76Average Score (%)17.8
Open Chinese LLM - CMMLU46.11Accuracy (%)15.7
Open PL LLM - Generative4.74Average Generative Score (%)15.4
Open Chinese LLM Leaderboard47.86Average Score (%)12.8

Interactive version: theaggregate.ai/model?slug=chatglm3-6b · How It Works · Data refreshed daily, snapshot 2026-09-05.