GLM-4.5V (Non-reasoning): benchmark results
Provider: Zhipu. Released 2025-08-11. Access: Open.
Unified ELO 1533 ± 20, rank #891 of 2055 rated models, from 56 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA Omniscience - Software Engineering (SWE) - JavaScript | 37.27 | Accuracy (%) | 75.8 |
| AA Omniscience - Software Engineering (SWE) - PHP | 26 | Accuracy (%) | 65 |
| AA Omniscience - Software Engineering (SWE) - Rust | 52 | Accuracy (%) | 64.7 |
| AA Omniscience - Software Engineering (SWE) - HTML | 32 | Accuracy (%) | 60.4 |
| AA Omniscience - Software Engineering (SWE) - TypeScript | 21.11 | Accuracy (%) | 57.5 |
| BunchCount - Group Counting | 8.83 | Mean absolute error (semantic groups per image, lower is bet | 57.1 |
| AA Omniscience - Software Engineering (SWE) - Java | 16 | Accuracy (%) | 57 |
| AA Omniscience - Software Engineering (SWE) - Go | 18 | Accuracy (%) | 56.5 |
| AA Omniscience - Software Engineering (SWE) - Python | 19.5 | Accuracy (%) | 56.1 |
| AA Omniscience - Software Engineering (SWE) - C | 32 | Accuracy (%) | 52.9 |
| AA-Omniscience Index - Software Engineering (SWE) - JavaScript | -25.45 | Omniscience Index | 49.6 |
| AA MMLU-Pro | 75.07 | Accuracy (%) | 48.9 |
Interactive version: theaggregate.ai/model?slug=glm-4-5v-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-29.