GLM-4.5 (Thinking): benchmark results

GLM-4.5 evaluated with thinking enabled. Provider: Zhipu. Released 2025-07-28. Access: Open.

Unified ELO 1606 ± 1, rank #409 of 1761 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LLM2014 Code 2025-09 - TypeScript8.89Score92.1
LLM2014 Code 2025-09 - C++5.62Score84.2
LLM2014 Code 2025-09 - Python7.15Score78.9
BenchTable60.8Total Score (%)71.7
LLM2014 Logic 2025-0842.18Median Score59.1
LLM2014 Code 2025-09 - C#6.94Score57.9
LLM2014 Code 2025-0937.21Median Score55.6
LisanBench0.03Mean Path Length / Current Maximum53.6
LLM2014 Logic 2025-0937.61Median Score51.1
Epoch AI - Algotune1.52Score50
VitaBench 2.036.9Avg@4 Full Context (self-reported)47.1
WeirdML40.58Average Score36.9

Interactive version: theaggregate.ai/model?slug=glm-4-5-thinking · How It Works · Data refreshed daily, snapshot 2026-09-05.