GLM-4.6V (Reasoning) — benchmark results

GLM-4.6V evaluated with reasoning enabled. Provider: Zhipu. Released 2025-12-09. Access: Open.

Unified ELO 1585 ± 28, rank #516 of 1776 rated models, from 56 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA AIME 202585.33Accuracy (%)83.3
UGI - Writing39.66Writing Score72.8
UGI - Natural Intelligence28.9NatInt Score71.9
AA MMLU-Pro79.89Accuracy (%)66.6
AA Omniscience-26.48Score66.1
AA Omniscience - Software Engineering (SWE) - Rust54Accuracy (%)59.5
AA Humanity's Last Exam8.85Accuracy (%)58.1
AA GPQA Diamond71.92Accuracy (%)56.1
AA Global-MMLU-Lite - English90.25Accuracy (%)53.8
Artificial Analysis Intelligence Index16.75Intelligence Index52.8
AA Global-MMLU-Lite - Korean83.75Accuracy (%)52.2
AA Omniscience - Software Engineering (SWE) - PHP24Accuracy (%)51.5

Interactive version: theaggregate.ai/model?slug=glm-4-6v-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.