GLM-5.1 FP8 — benchmark results

GLM-5.1 evaluated in FP8 quantization. Provider: Zhipu. Released 2026-03-27. Access: Open.

Unified ELO 1749 ± 22, rank #201 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MATH-MC Level 499.58Accuracy (%)95.6
JudgeBench Knowledge88.31Accuracy (%)92.2
RewardBench 2 Factuality84.47Accuracy (%)92.2
MATH-MC Level 599.69Accuracy (%)90.4
RewardBench 2 Precise IF73.28Accuracy (%)90.2
JudgeBench Coding97.62Accuracy (%)88.2
MATH-MC Level 198.84Accuracy (%)85.3
GSM-MC99.24Accuracy (%)81.3
MATH-MC Level 399.1Accuracy (%)79.4
MATH-MC Level 298.53Accuracy (%)71.3
RewardBench 2 Math89.07Accuracy (%)68.6
RewardBench 2 Focus90.15Accuracy (%)65.7

Interactive version: theaggregate.ai/model?slug=glm-5-1-fp8 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.