GLM-4.5 (Reasoning) — benchmark results

GLM-4.5 evaluated with reasoning enabled. Provider: Zhipu. Released 2025-07-28. Access: Open.

Unified ELO 1696 ± 23, rank #279 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Writing57.34Writing Score92.4
AA MATH-50097.87Accuracy (%)90.1
UGI - Natural Intelligence46.56NatInt Score89.5
AA LiveCodeBench73.76Pass@1 (%)85.1
AA MMLU-Pro83.51Accuracy (%)84.3
AA Omniscience - Software Engineering (SWE) - Rust66Accuracy (%)80.6
AA Omniscience - Health26.6Accuracy (%)75.8
AA Omniscience - Software Engineering (SWE) - JavaScript40.91Accuracy (%)72
AA Omniscience - Software Engineering (SWE) - Go28Accuracy (%)71.5
AA Omniscience - Software Engineering (SWE) - TypeScript35.56Accuracy (%)70.6
AA Omniscience - Software Engineering (SWE) - Julia24Accuracy (%)70.4
AA Omniscience - Humanities & Social Sciences25.8Accuracy (%)69.9

Interactive version: theaggregate.ai/model?slug=glm-4-5-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.