GLM-4 32B: benchmark results

Zhipu's open GLM-4 32B model (0414 release). Provider: Zhipu. Released 2025-04-14. Access: Open.

Unified ELO 1548 ± 1, rank #449 of 1392 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
VisualWebArena48.7Success Rate (%)93.5
SWE-Arena1002Elo Score80.6
EHRBench66.12Overall Acc (%) (self-reported)78.3
Benchmarking Large Language Models for Graphem35.62Direct (self-reported)77.8
SnakeBench23.7TrueSkill Rating58.2
Wolfram LLM Benchmarking Project40.9Correct Functionality (%)48.5
MemPoison - Clean Task94.83Success Rate (%)44.4
Active Evidence-Seeking and Diagnostic Reasoni35.7Task 2: Active Seeking Exact Accuracy (self-reported)42.9
MemPoison - Poisoned Task2.64Success Rate (%)38.9
AI Chess Leaderboard (Continuation)514Elo37.5
AsyncTool15.17Overall (self-reported)33.3
Kagi LLM Benchmark42.3Accuracy (%)27.5

Interactive version: theaggregate.ai/model?slug=glm-4-32b · How It Works · Data refreshed daily, snapshot 2026-09-05.