GLM-5.1 — benchmark results
Zhipu GLM-5.1 model for reasoning, coding, and agentic tasks. Provider: Zhipu. Released 2026-03-27. Access: Open.
Unified ELO 1769 ± 12, rank #167 of 1776 rated models, from 364 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| AGC-Bench - cue_word_story | 1.25 | Dataset z-score | 100 |
| AGC-Bench - simile_generation | 1.9 | Dataset z-score | 100 |
| Are Agents Ready to Teach? A Multi-Stage Bench | 63.8 | Eq. pass (self-reported) | 100 |
| GACL - WordMatrix | 68.33 | Normalized Score (0-100) | 100 |
| POLAR-Bench | 94.34 | Overall Mean (self-reported) | 100 |
| SalesBench | 0.51 | 50-Lead Reward | 100 |
| TERMS-Bench | 11.7 | Mean Utility | 100 |
| TimeSage-MT | 40.5 | Overall (self-reported) | 100 |
| SWE-rebench | 62.67 | Resolved (%) | 98.9 |
| AGC-Bench - scar | 1.08 | Dataset z-score | 98.8 |
| AGC-Bench - outline_to_story | 1.58 | Dataset z-score | 97.5 |
| Arena AI Code | 1532 | Arena ELO (self-reported) | 96.8 |
Interactive version: theaggregate.ai/model?slug=glm-5-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.