GLM-5.3 Flash: benchmark results
Provider: Zhipu. Released 2026-08-27. Access: Open.
Unified ELO 1704 ± 1, rank #49 of 1392 rated models, from 159 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| LLM Stats (MMVU) | 80.5 | Score (%) | 100 |
| LLM Stats (MVBench) | 77.8 | Score (%) | 100 |
| LLM Stats (Toolathlon) | 78.4 | Score (%) | 100 |
| ProphetArena | 0.96 | 1 - Brier Score | 100 |
| Nejumi 4 - MT-Bench (Japanese) | 98.75 | Score (%) | 98.8 |
| Chatbot Arena (Text - Coding) | 1534 | Arena Score | 98.1 |
| AA GDPval | 1674.12 | ELO | 97.5 |
| Hebrew LLM - Summarization (Pairwise) | 60.52 | Pairwise Score (%) | 97 |
| Nejumi 4 - GLP - Logical Reasoning | 96 | Score (%) | 96.7 |
| Chatbot Arena (Text - Chinese) | 1532 | Arena Score | 96.4 |
| Tau3 Banking | 47.22 | Success Rate (%) | 96 |
| LLM Stats Score | 50.69 | LLM Stats Score (conservative rating) | 95.7 |
Interactive version: theaggregate.ai/model?slug=glm-5-3-flash · How It Works · Data refreshed daily, snapshot 2026-09-05.