GLM-4.6 FP8 — benchmark results

GLM-4.6 evaluated in FP8 quantization. Provider: Zhipu. Released 2025-09-30. Access: Open.

Unified ELO 1682 ± 21, rank #305 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MATH-MC Level 599.69Accuracy (%)90.4
RewardBench 2 Math90.44Accuracy (%)89.2
RewardBench 2 Focus90.91Accuracy (%)81.4
MATH-MC Level 198.6Accuracy (%)75
MATH-MC Level 499.33Accuracy (%)75
MATH-MC Level 298.53Accuracy (%)71.3
RewardBench 2 Factuality77.95Accuracy (%)66.7
RewardBench 2 Safety87.11Accuracy (%)64.7
RewardBench 2 Precise IF64.06Accuracy (%)62.7
GSM-MC99.01Accuracy (%)61.2
MATH-MC Level 398.65Accuracy (%)52.9
JudgeBench Coding91.67Accuracy (%)47.1

Interactive version: theaggregate.ai/model?slug=glm-4-6-fp8 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.