GLM-4.6 (Reasoning) — benchmark results

GLM-4.6 evaluated with reasoning enabled. Provider: Zhipu. Released 2025-09-30. Access: Open.

Unified ELO 1717 ± 16, rank #248 of 1776 rated models, from 58 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Writing53.31Writing Score90.4
UGI - Natural Intelligence44.94NatInt Score88.9
AA Omniscience - Software Engineering (SWE) - R38Accuracy (%)84
AA AIME 202586Accuracy (%)83.7
AA MMLU-Pro82.92Accuracy (%)82.6
AA Omniscience - Software Engineering (SWE) - Go36Accuracy (%)80.6
AA Omniscience - Software Engineering (SWE) - Rust66Accuracy (%)80.6
AA Omniscience - Science, Engineering & Mathematics36.8Accuracy (%)80.1
AA Global-MMLU-Lite - Korean87.67Accuracy (%)79.1
AA LiveCodeBench69.52Pass@1 (%)78.9
AA Omniscience - Health28.2Accuracy (%)77.2
AA Global-MMLU-Lite - Arabic87Accuracy (%)76.3

Interactive version: theaggregate.ai/model?slug=glm-4-6-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.