GLM-4.6 (Non-reasoning): benchmark results

GLM-4.6 evaluated with reasoning disabled. Provider: Zhipu. Released 2025-09-30. Access: Open.

Unified ELO 1532 ± 1, rank #711 of 1761 rated models, from 39 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - Julia32Accuracy (%)90.1
UGI Leaderboard49.83UGI Score89.5
UGI - Writing50.01Writing Score88.3
UGI - Natural Intelligence41.7NatInt Score87.3
AA Omniscience - Software Engineering (SWE) - Java26Accuracy (%)86
AA Omniscience - Software Engineering (SWE) - Go28Accuracy (%)80.7
AA Omniscience - Software Engineering (SWE) - JavaScript39.09Accuracy (%)79.5
AA Omniscience - Software Engineering (SWE) - TypeScript31.11Accuracy (%)77.1
AA Omniscience - Software Engineering (SWE) - PHP32Accuracy (%)75.9
AA Omniscience - Software Engineering (SWE) - Kotlin24Accuracy (%)72.5
AA Terminal-Bench Hard28.79Accuracy (%)70.8
AA Omniscience - Software Engineering (SWE) - Python24Accuracy (%)70.3

Interactive version: theaggregate.ai/model?slug=glm-4-6-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.