GLM-5.3 Flash (Max): benchmark results

Provider: Zhipu. Released 2026-08-27. Access: Open.

Unified ELO 1694 ± 1, rank #122 of 1761 rated models, from 31 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Vals AI MedScribe88.94Accuracy (%)96.9
Vals AI SWE-bench Verified92Resolved (%)89.7
Vals AI TaxEval v275.59Accuracy (%)89.6
LLM2014 Logic 2026-0860.52Median Score88.6
Vals AI Finance Agent v257.85Accuracy (%)87.5
Vals AI Legal Research Bench45.19Accuracy (%)87.5
OTIS Mock AIME 2024-2593.89Accuracy (%)85.2
LLM2014 Logic 2026-0957.61Median Score84.1
Vals AI MMMU86.01Accuracy (%)76.1
FrontierMath - Tiers 1-3 (v2)55.79Accuracy (%, 285 private v2 problems)75.2
Vals AI LegalBench83.93Accuracy (%)71.6
VoxelBench1800Rating70.2

Interactive version: theaggregate.ai/model?slug=glm-5-3-flash-max · How It Works · Data refreshed daily, snapshot 2026-09-05.