GLM-5 (Non-reasoning): benchmark results

GLM-5 evaluated with reasoning disabled. Provider: Zhipu. Released 2026-02-12. Access: Open.

Unified ELO 1575 ± 1, rank #533 of 1761 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench97.37Accuracy (%)97.5
UGI - Natural Intelligence49.38NatInt Score89.9
UGI - Writing49.22Writing Score87.9
AA Omniscience - Software Engineering (SWE) - PHP42Accuracy (%)87.2
AA Omniscience - Software Engineering (SWE) - Python35.5Accuracy (%)87
AA Omniscience - Software Engineering (SWE) - C55Accuracy (%)86.7
AA Terminal-Bench Hard39.39Accuracy (%)86.5
AA Omniscience - Software Engineering (SWE) - Go32Accuracy (%)85.5
CLEM TextMapWorld SpecificRoom100Game Clemscore (%)81.7
AA Omniscience - Software Engineering (SWE) - Java22Accuracy (%)79.5
AA Omniscience - Software Engineering (SWE) - HTML42Accuracy (%)78.3
AA Omniscience - Software Engineering (SWE) - TypeScript31.11Accuracy (%)77.1

Interactive version: theaggregate.ai/model?slug=glm-5-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.