GLM-4.7 FP8 — benchmark results

FP8 precision evaluation row for Zhipu GLM-4.7. Provider: Zhipu. Released 2025-12-22. Access: Open.

Unified ELO 1693 ± 19, rank #284 of 1776 rated models, from 71 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Danish76.67Average Score (%)99.1
Medmarks - LongHealth Task 191.17Score (%)98.6
Medmarks - MedQA94.79Score (%)98.6
EuroEval Danish NLU68.61NLU Average Score (%)98.4
EuroEval Danish Common Sense Reasoning81.97Common Sense Reasoning Average Score (%)98.3
EuroEval Danish NLU - Angry Tweets61.64Sentiment classification Score (%)98.2
EuroEval Danish NLU - Dansk70.24Named entity recognition Score (%)98.1
Medmarks - MedXpertQA Reasoning43.69Score (%)95.7
Medmarks - MedXpertQA Understanding42.11Score (%)95.7
Medmarks - Medbullets OP487.99Score (%)95.7
Medmarks - Medbullets OP584.52Score (%)95.7
Medmarks - SuperGPQA Medicine Hard48.39Score (%)95.7

Interactive version: theaggregate.ai/model?slug=glm-4-7-fp8 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.