GLM-5.3 Flash (Low): benchmark results

Provider: Zhipu. Released 2026-08-20. Access: Open.

Unified ELO 1721 ± 29, rank #310 of 2066 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
K-Bench98.36Overall (%, Default v1 prompt)81.1
K-Bench (Therapeutic v0)97.96Overall (%, Therapeutic v0 prompt)75.8
K-Bench - Risk (Therapeutic v0)91.83Risk Score (%, Therapeutic v0 prompt)62.1
Context Arena59.1Average Score (%)61
ARC-AGI-227.92Accuracy (%)52.7
K-Bench - Risk91.69Risk Score (%, Default v1 prompt)52.5
DuelLab Overall35.1DuelLab Score50
ARC-AGI-147Accuracy (%)35.3
Bug Hunt Bench - VS Code Extension7Planted Bugs Fixed (out of 45)33.3
NonoBench23.3Overall Accuracy (%)18.6
Bug Hunt Bench9Planted Bugs Fixed (out of 105)10.6
CursorBench 4.026.9Score (%)10

Interactive version: theaggregate.ai/model?slug=glm-5-3-flash-low · How It Works · Data refreshed daily, snapshot 2026-10-05.