GLM-4.6V-Flash: benchmark results

Provider: Zhipu. Access: Open.

Unified ELO 1703 ± 26, rank #321 of 2653 rated models, from 18 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GEB-Bench - Story-Theorem Matching47.1Accuracy (%; 4-way, chance 25%)68.1
GEB-Bench - Scene-Theorem Matching52.9Accuracy (%; 4-way, chance 25%)61.5
OCRBench-V2 (zh)59.5Score (self-reported)60
GEB-Bench - Theorem Identification76Accuracy (%; 25-way, chance 4%)59.7
GEB-Bench - Scene-Story Matching32.9Accuracy (%; 4-way, chance 25%)59.6
OCRBench v259.5Average (self-reported)57.7
TRAP19.7Overall HM (self-reported)57.1
GEB-Bench - Story Identification38.8Accuracy (%; 25-way, chance 4%)55.6
GEB-Bench - Adversarial Matching72.4Accuracy (%; 4-way, chance 25%)53.8
GEB-Bench - Average (Vision Models)53Macro-average accuracy over all eight tasks (%)53.8
OCRBench-V2 (en)59Score (self-reported)52
SciTrue - Claim Validation79.6F1 (%)50

Interactive version: theaggregate.ai/model?slug=glm-4-6v-flash · How It Works · Data refreshed daily, snapshot 2026-09-21.