GLM-4.7 (Non-reasoning) — benchmark results

GLM-4.7 evaluated with reasoning disabled. Provider: Zhipu. Released 2025-12-22. Access: Open.

Unified ELO 1644 ± 38, rank #385 of 1776 rated models, from 57 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench94.15Accuracy (%)92
UGI Leaderboard49.36UGI Score88.7
UGI - Natural Intelligence42.52NatInt Score88.2
UGI - Writing44.16Writing Score85.2
AA Omniscience - Software Engineering (SWE) - PHP44Accuracy (%)78.9
AA Omniscience - Software Engineering (SWE) - Go32Accuracy (%)76.8
AA Terminal-Bench Hard30.3Accuracy (%)72.3
AA Omniscience - Software Engineering (SWE) - Kotlin28Accuracy (%)71.9
AA Omniscience - Health24.7Accuracy (%)71.2
Artificial Analysis Intelligence Index26.56Intelligence Index71.1
AA Omniscience - Software Engineering (SWE) - Swift48Accuracy (%)69.5
AA Omniscience - Software Engineering (SWE) - C49Accuracy (%)68.8

Interactive version: theaggregate.ai/model?slug=glm-4-7-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.