GLM-4 (0520): benchmark results

Provider: Zhipu. Released 2024-06-05. Access: API.

Unified ELO 1587 ± 30, rank #680 of 2656 rated models, from 92 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SuperCLUE General (June 2024) - Hard79Score92.2
OpenCompass Knowledge - Social Science - Chinese (CompassBench 2407)80Score (%)88.2
SuperCLUE General (June 2024) - Overall76Score87.5
OpenCompass Knowledge - Social Science - English (CompassBench 2407)87.2Score (%)85.3
OpenCompass LLM - Code (CompassBench 2407)56.3Score (%)85.3
OpenCompass LLM - Code - Chinese (CompassBench 2407)55.8Score (%)85.3
OpenCompass Reasoning - Science and Engineering - English (CompassBench 2407)51Score (%)83.8
OpenCompass Code - LCBench - English (CompassBench 2407)52.4Score (%)82.4
OpenCompass Reasoning - Humanities - English (CompassBench 2407)49.9Score (%)82.4
OpenCompass Code - HumanEval - Chinese (CompassBench 2407)76.2Score (%)80.9
OpenCompass Code - LCBench - Chinese (CompassBench 2407)43.6Score (%)79.4
SuperCLUE General (August 2024) - Hard65.28Score78

Interactive version: theaggregate.ai/model?slug=glm-4-0520 · How It Works · Data refreshed daily, snapshot 2026-09-19.