GLM-4 32B — benchmark results

Zhipu's open GLM-4 32B model (0414 release). Provider: Zhipu. Released 2025-04-14. Access: Open.

Unified ELO 1586 ± 49, rank #513 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
VisualWebArena48.7Success Rate (%)93.5
SuiChat-CN74.7Standard F1 (self-reported)93
SWE-Arena1002Elo Score80.6
EHRBench66.12Overall Acc (%) (self-reported)78.3
Benchmarking Large Language Models for Graphem35.62Direct (self-reported)77.8
Wolfram LLM Benchmarking Project40.9Correct Functionality (%)50.4
Active Evidence-Seeking and Diagnostic Reasoni35.7Task 2: Active Seeking Exact Accuracy (self-reported)42.9
AI Chess Leaderboard (Continuation)514Elo39.9
AsyncTool15.17Overall (self-reported)33.3
Kagi LLM Benchmark42.3Accuracy (%)27.9
Creative Writing v31143.4Elo score (self-reported)25.7
EQ-Bench Creative Writing v3996.2Elo25

Interactive version: theaggregate.ai/model?slug=glm-4-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.