GLM-4.7 (Non-reasoning): benchmark results

GLM-4.7 evaluated with reasoning disabled. Provider: Zhipu. Released 2025-12-22. Access: Open.

Unified ELO 1554 ± 1, rank #617 of 1761 rated models, from 58 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench94.15Accuracy (%)92
AA Omniscience - Software Engineering (SWE) - PHP44Accuracy (%)88.9
UGI Leaderboard49.36UGI Score88.6
UGI - Natural Intelligence42.52NatInt Score87.5
AA Omniscience - Software Engineering (SWE) - Go32Accuracy (%)85.5
UGI - Writing44.16Writing Score84.5
AA Omniscience - Software Engineering (SWE) - Kotlin30Accuracy (%)84.1
AA Omniscience - Software Engineering (SWE) - Swift48Accuracy (%)82.4
AA Omniscience - Software Engineering (SWE) - TypeScript33.33Accuracy (%)79.4
AA Omniscience - Software Engineering (SWE) - C48Accuracy (%)78.3
AA Omniscience - Software Engineering (SWE) - Python27.5Accuracy (%)78
AA Omniscience - Software Engineering (SWE) - Java21Accuracy (%)77.3

Interactive version: theaggregate.ai/model?slug=glm-4-7-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.