GLM-5.1 (Non-reasoning): benchmark results

GLM-5.1 evaluated with reasoning disabled. Provider: Zhipu. Released 2026-03-27. Access: Open.

Unified ELO 1601 ± 1, rank #432 of 1761 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench97.08Accuracy (%)97.3
AA Omniscience - Software Engineering (SWE) - HTML58Accuracy (%)94.7
UGI - Writing54.9Writing Score90.7
UGI - Natural Intelligence49.51NatInt Score90.1
AA Omniscience - Software Engineering (SWE) - PHP42Accuracy (%)87.2
AA Omniscience - Software Engineering (SWE) - Python34Accuracy (%)85.7
AA Omniscience - Software Engineering (SWE) - C53Accuracy (%)84.1
AA Omniscience - Software Engineering (SWE) - JavaScript40.91Accuracy (%)83.4
AA Omniscience - Software Engineering (SWE) - Java24Accuracy (%)83.3
AA Omniscience - Software Engineering (SWE) - TypeScript36.67Accuracy (%)82.4
AA Terminal-Bench Hard35.61Accuracy (%)82
AA Omniscience - Software Engineering (SWE) - Julia24Accuracy (%)80.2

Interactive version: theaggregate.ai/model?slug=glm-5-1-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.