GLM-4.5V (Non-reasoning): benchmark results

Provider: Zhipu. Released 2025-08-11. Access: Open.

Unified ELO 1533 ± 20, rank #891 of 2055 rated models, from 56 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA Omniscience - Software Engineering (SWE) - JavaScript37.27Accuracy (%)75.8
AA Omniscience - Software Engineering (SWE) - PHP26Accuracy (%)65
AA Omniscience - Software Engineering (SWE) - Rust52Accuracy (%)64.7
AA Omniscience - Software Engineering (SWE) - HTML32Accuracy (%)60.4
AA Omniscience - Software Engineering (SWE) - TypeScript21.11Accuracy (%)57.5
BunchCount - Group Counting8.83Mean absolute error (semantic groups per image, lower is bet57.1
AA Omniscience - Software Engineering (SWE) - Java16Accuracy (%)57
AA Omniscience - Software Engineering (SWE) - Go18Accuracy (%)56.5
AA Omniscience - Software Engineering (SWE) - Python19.5Accuracy (%)56.1
AA Omniscience - Software Engineering (SWE) - C32Accuracy (%)52.9
AA-Omniscience Index - Software Engineering (SWE) - JavaScript-25.45Omniscience Index49.6
AA MMLU-Pro75.07Accuracy (%)48.9

Interactive version: theaggregate.ai/model?slug=glm-4-5v-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-29.