GLM-5.1 (Non-reasoning) — benchmark results

GLM-5.1 evaluated with reasoning disabled. Provider: Zhipu. Released 2026-03-27. Access: Open.

Unified ELO 1742 ± 44, rank #209 of 1776 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench97.08Accuracy (%)97.3
UGI - Writing54.9Writing Score91.4
UGI - Natural Intelligence49.51NatInt Score90.8
AA Humanity's Last Exam25.63Accuracy (%)85.5
AA Omniscience - Software Engineering (SWE) - HTML58Accuracy (%)85.3
Artificial Analysis Intelligence Index35.37Intelligence Index84
AA Terminal-Bench Hard35.61Accuracy (%)82
AA GPQA Diamond83.94Accuracy (%)80.6
AA Omniscience - Software Engineering (SWE) - PHP42Accuracy (%)77
AA Omniscience - Software Engineering (SWE) - Python33Accuracy (%)74.1
AA Omniscience - Software Engineering (SWE) - JavaScript41.82Accuracy (%)73.7
AA Omniscience - Software Engineering (SWE) - C54Accuracy (%)73.5

Interactive version: theaggregate.ai/model?slug=glm-5-1-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.