GLM-4.6 (Non-reasoning) — benchmark results

GLM-4.6 evaluated with reasoning disabled. Provider: Zhipu. Released 2025-09-30. Access: Open.

Unified ELO 1648 ± 26, rank #374 of 1776 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI Leaderboard49.83UGI Score89.6
UGI - Writing50.01Writing Score89
UGI - Natural Intelligence41.7NatInt Score87.9
AA Omniscience - Software Engineering (SWE) - Julia32Accuracy (%)80.6
AA Omniscience - Software Engineering (SWE) - Go28Accuracy (%)71.5
AA Terminal-Bench Hard28.79Accuracy (%)70.8
AA Omniscience - Software Engineering (SWE) - Java23Accuracy (%)68.6
AA TAU-2 Bench76.9Accuracy (%)68
Artificial Analysis Intelligence Index22.98Intelligence Index65.3
AA Omniscience - Software Engineering (SWE) - PHP32Accuracy (%)65
AA Omniscience - Software Engineering (SWE) - Kotlin24Accuracy (%)64.2
AA Omniscience - Software Engineering (SWE) - TypeScript30Accuracy (%)64.1

Interactive version: theaggregate.ai/model?slug=glm-4-6-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.