GLM-4 9B Chat: benchmark results

Zhipu AI's open GLM-4 9B chat model, the small tier of the GLM-4 family (June 2024). Provider: Zhipu. Released 2024-06-05. Access: Open.

Unified ELO 1466 ± 1, rank #865 of 1392 rated models, from 49 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Fin-Bias98.1Average Herding Score (with rating) (self-reported)88.9
Open PL LLM - RAG69.3Average RAG Score (%)76.9
Open PL LLM - Generative61.64Average Generative Score (%)74.5
ChineseSafe Benchmark70.96Accuracy (%)74.1
LogicKor - Reasoning7.07Score (0-10)73.3
Open PL LLM Leaderboard56.61Average Score (%)72.4
LogicKor - Multi-Turn7.28Score (0-10)72.1
Greek MMLU - Other65.85Accuracy (%)71.6
Open LLM Leaderboard - GPQA8.5Score70.7
Polish EQ-Bench61.79EQ-Bench Score70.3
TextClass Benchmark1616.51Meta-Elo (self-reported)70.1
LogicKor - Writing8.64Score (0-10)68.3

Interactive version: theaggregate.ai/model?slug=glm-4-9b-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.