GLM-5.2 (Max): benchmark results
GLM-5.2 evaluated at the max reasoning-effort setting. Provider: Zhipu. Released 2026-06-13. Access: Open.
Unified ELO 1685 ± 1, rank #142 of 1761 rated models, from 114 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AA TAU-2 Bench | 99.12 | Accuracy (%) | 99.9 |
| Chatbot Arena (Text - Spanish) | 1480 | Arena Score | 95.9 |
| AA Terminal-Bench Hard | 50.76 | Accuracy (%) | 95 |
| AA CritPt | 20.86 | Accuracy (%) | 93.3 |
| AA Omniscience - Software Engineering (SWE) - TypeScript | 48.89 | Accuracy (%) | 93.3 |
| Chatbot Arena (Text - English) | 1480 | Arena Score | 92.7 |
| LLM2014 Logic 2026-06 | 71.16 | Median Score | 92.5 |
| Artificial Analysis Intelligence Index | 42.54 | Intelligence Index | 92.4 |
| Chatbot Arena (Text - Creative Writing) | 1451 | Arena Score | 92.3 |
| AA Omniscience - Software Engineering (SWE) - Python | 41 | Accuracy (%) | 92.2 |
| Chatbot Arena (Text - Chinese) | 1517 | Arena Score | 92.2 |
| AA Humanity's Last Exam | 41.15 | Accuracy (%) | 92 |
Interactive version: theaggregate.ai/model?slug=glm-5-2-max · How It Works · Data refreshed daily, snapshot 2026-09-05.