GLM-4.7 (Reasoning): benchmark results

GLM-4.7 evaluated with reasoning enabled. Provider: Zhipu. Released 2025-12-22. Access: Open.

Unified ELO 1624 ± 1, rank #339 of 1761 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench89.42Pass@1 (%)99.4
AA AIME 202595Accuracy (%)97.8
AA TAU-2 Bench95.91Accuracy (%)96.2
AA MMLU-Pro85.61Accuracy (%)92.8
AA Omniscience - Software Engineering (SWE) - HTML54Accuracy (%)91.1
AA Omniscience - Software Engineering (SWE) - PHP46Accuracy (%)90.3
UGI Leaderboard49.57UGI Score89.1
UGI - Natural Intelligence46.9NatInt Score89
AA Omniscience - Software Engineering (SWE) - JavaScript46.36Accuracy (%)88.4
AA Omniscience - Software Engineering (SWE) - Dart32Accuracy (%)87.4
UGI - Writing47.38Writing Score87.2
AA Omniscience - Software Engineering (SWE) - C55Accuracy (%)86.7

Interactive version: theaggregate.ai/model?slug=glm-4-7-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.