GLM-5.3 Flash (Max): benchmark results
Provider: Zhipu. Released 2026-08-27. Access: Open.
Unified ELO 1694 ± 1, rank #122 of 1761 rated models, from 31 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Vals AI MedScribe | 88.94 | Accuracy (%) | 96.9 |
| Vals AI SWE-bench Verified | 92 | Resolved (%) | 89.7 |
| Vals AI TaxEval v2 | 75.59 | Accuracy (%) | 89.6 |
| LLM2014 Logic 2026-08 | 60.52 | Median Score | 88.6 |
| Vals AI Finance Agent v2 | 57.85 | Accuracy (%) | 87.5 |
| Vals AI Legal Research Bench | 45.19 | Accuracy (%) | 87.5 |
| OTIS Mock AIME 2024-25 | 93.89 | Accuracy (%) | 85.2 |
| LLM2014 Logic 2026-09 | 57.61 | Median Score | 84.1 |
| Vals AI MMMU | 86.01 | Accuracy (%) | 76.1 |
| FrontierMath - Tiers 1-3 (v2) | 55.79 | Accuracy (%, 285 private v2 problems) | 75.2 |
| Vals AI LegalBench | 83.93 | Accuracy (%) | 71.6 |
| VoxelBench | 1800 | Rating | 70.2 |
Interactive version: theaggregate.ai/model?slug=glm-5-3-flash-max · How It Works · Data refreshed daily, snapshot 2026-09-05.