GLM-5.2 (Max): benchmark results

GLM-5.2 evaluated at the max reasoning-effort setting. Provider: Zhipu. Released 2026-06-13. Access: Open.

Unified ELO 1685 ± 1, rank #142 of 1761 rated models, from 114 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA TAU-2 Bench99.12Accuracy (%)99.9
Chatbot Arena (Text - Spanish)1480Arena Score95.9
AA Terminal-Bench Hard50.76Accuracy (%)95
AA CritPt20.86Accuracy (%)93.3
AA Omniscience - Software Engineering (SWE) - TypeScript48.89Accuracy (%)93.3
Chatbot Arena (Text - English)1480Arena Score92.7
LLM2014 Logic 2026-0671.16Median Score92.5
Artificial Analysis Intelligence Index42.54Intelligence Index92.4
Chatbot Arena (Text - Creative Writing)1451Arena Score92.3
AA Omniscience - Software Engineering (SWE) - Python41Accuracy (%)92.2
Chatbot Arena (Text - Chinese)1517Arena Score92.2
AA Humanity's Last Exam41.15Accuracy (%)92

Interactive version: theaggregate.ai/model?slug=glm-5-2-max · How It Works · Data refreshed daily, snapshot 2026-09-05.