GLM-4.7 Flash (Non-reasoning): benchmark results

GLM-4.7 Flash evaluated with reasoning disabled. Provider: Zhipu. Released 2026-01-19. Access: Open.

Unified ELO 1484 ± 1, rank #942 of 1761 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench91.81Accuracy (%)86.9
UGI - Willingness (W/10)6.8W/10 Score67
AA Omniscience - Software Engineering (SWE) - Julia12.5Accuracy (%)63.8
AA IFBench46.26Accuracy (%)54.5
AA Omniscience - Software Engineering (SWE) - Python18.09Accuracy (%)52.6
AA Omniscience - Software Engineering (SWE) - Java15Accuracy (%)49.8
UGI Leaderboard33.75UGI Score46.8
Artificial Analysis Intelligence Index9.56Intelligence Index46.7
UGI - Natural Intelligence20.96NatInt Score45.3
AA Omniscience - Software Engineering (SWE) - PHP18Accuracy (%)43
AA Omniscience - Software Engineering (SWE) - Kotlin14Accuracy (%)39.8
AA Omniscience - Software Engineering (SWE) - C27Accuracy (%)38.2

Interactive version: theaggregate.ai/model?slug=glm-4-7-flash-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.