GLM-4.7 — benchmark results

Zhipu GLM-4.7 model row. Provider: Zhipu. Released 2025-12-22. Access: Open.

Unified ELO 1720 ± 11, rank #241 of 1776 rated models, from 260 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEvals - EvasionBench82.91Accuracy (%)100
AGC-Bench - historical_analogy1.94Dataset z-score99.4
FormationEval98.6Accuracy (%)98.6
AGC-Bench - c3_crosstalk1.42Dataset z-score97.6
CLEM Hot Air Balloon90.89Game Clemscore (%)95.8
AGC-Bench - arn0.86Dataset z-score95.7
AGC-Bench - schnovel1.56Dataset z-score95.7
OpenCompass Research - LiveCodeBench v683.8Score (%)95.7
AGC-Bench - Problem Solving0.72JRT z-score95.1
AGC-Bench - lcc_metaphor1.21Dataset z-score95.1
AGC-Bench - simile_generation1.35Dataset z-score95
AGC-Bench - fig_qa2.38Dataset z-score94.5

Interactive version: theaggregate.ai/model?slug=glm-4-7 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.