GLM-5.1 — benchmark results

Zhipu GLM-5.1 model for reasoning, coding, and agentic tasks. Provider: Zhipu. Released 2026-03-27. Access: Open.

Unified ELO 1769 ± 12, rank #167 of 1776 rated models, from 364 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - cue_word_story1.25Dataset z-score100
AGC-Bench - simile_generation1.9Dataset z-score100
Are Agents Ready to Teach? A Multi-Stage Bench63.8Eq. pass (self-reported)100
GACL - WordMatrix68.33Normalized Score (0-100)100
POLAR-Bench94.34Overall Mean (self-reported)100
SalesBench0.5150-Lead Reward100
TERMS-Bench11.7Mean Utility100
TimeSage-MT40.5Overall (self-reported)100
SWE-rebench62.67Resolved (%)98.9
AGC-Bench - scar1.08Dataset z-score98.8
AGC-Bench - outline_to_story1.58Dataset z-score97.5
Arena AI Code1532Arena ELO (self-reported)96.8

Interactive version: theaggregate.ai/model?slug=glm-5-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.