GLM-4.5V: benchmark results

Provider: Zhipu. Released 2025-07-28. Access: Open.

Unified ELO 1543 ± 1, rank #469 of 1392 rated models, from 125 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - chinese_homophonic_puns1.33Dataset z-score96.3
FlagEval VQA - Spatial Reasoning38.6Score82.6
MathVision65.6Overall Accuracy (%)78.8
FlagEval VQA - Text Understanding (Chinese)75.3Score78.3
StemBind34.6F Overall (self-reported)69.6
AGC-Bench - grapheval_ai_researcher0.44Dataset z-score67.9
AGC-Bench - analobench0.59Dataset z-score67.3
SciEval - Life Sciences54.11Life Sciences (%)66.7
Math-VR49.6Overall Answer Correctness (self-reported)65.5
Kagi LLM Benchmark59.8Accuracy (%)64.1
Physical AI Bench - Understanding Overall59.2Overall Score (%)62.5
Physical AI Bench Understanding59.2Overall Score (%)62.5

Interactive version: theaggregate.ai/model?slug=glm-4-5v · How It Works · Data refreshed daily, snapshot 2026-09-05.