GLM-4.6V (Non-reasoning) — benchmark results

GLM-4.6V evaluated with reasoning disabled. Provider: Zhipu. Released 2025-12-09. Access: Open.

Unified ELO 1567 ± 19, rank #574 of 1776 rated models, from 56 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
UGI - Natural Intelligence32.31NatInt Score78.8
AA Omniscience - Software Engineering (SWE) - Rust56Accuracy (%)64.3
AA Omniscience - Software Engineering (SWE) - C45Accuracy (%)63.4
AA Omniscience - Software Engineering (SWE) - Swift44Accuracy (%)63.3
AA Omniscience - Software Engineering (SWE) - Julia16Accuracy (%)57.8
UGI - Writing35.21Writing Score56.2
AA Omniscience-37.87Score55.1
UGI Leaderboard34.72UGI Score51.3
AA LiveCodeBench41.06Pass@1 (%)49.4
AA MMLU-Pro75.16Accuracy (%)49.4
AA Omniscience - Software Engineering (SWE) - JavaScript29.09Accuracy (%)48.9
AA Omniscience - Software Engineering (SWE)22.7Accuracy (%)46.2

Interactive version: theaggregate.ai/model?slug=glm-4-6v-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.