GLM-4.5V — benchmark results

Provider: Zhipu. Released 2025-07-28. Access: Open.

Unified ELO 1376 ± 31, rank #1322 of 1776 rated models, from 100 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - chinese_homophonic_puns1.33Dataset z-score96.3
CFMME60.78Average (self-reported)86.7
MathVision65.6Overall Accuracy (%)78.3
StemBind34.6F Overall (self-reported)69.6
AGC-Bench - grapheval_ai_researcher0.44Dataset z-score67.9
AGC-Bench - analobench0.59Dataset z-score67.3
Math-VR49.6Overall Answer Correctness (self-reported)66.7
SciEval - Life Sciences54.11Life Sciences (%)66.7
Kagi LLM Benchmark59.8Accuracy (%)64.3
Physical AI Bench - Understanding Overall59.2Overall Score (%)62.5
Physical AI Bench Understanding59.2Overall Score (%)62.5
CulMind43.8S (self-reported)61.5

Interactive version: theaggregate.ai/model?slug=glm-4-5v · How the rankings work · Data refreshed daily, snapshot 2026-07-22.