LongWriter-glm4-9B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1380 ± 131, rank #2046 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - BLUEX59.81Accuracy (%)76.9
Open Portuguese LLM - ENEM70.19Accuracy (%)75.2
Enkrypt AI - Bias Risk82.17Risk Score56.1
Open Portuguese LLM - OAB Exams42.41Accuracy (%)51.7
Enkrypt AI - Jailbreak Risk8.53Risk Score50.4
Enkrypt AI - Insecure Code Risk31.11Risk Score49.6
Enkrypt AI - Risk Score33.96Risk Score44.7
Open Portuguese LLM - ASSIN2 RTE84.03Macro F1 (%)33.9
Enkrypt AI - Toxicity Risk8.64Risk Score19.1
Enkrypt AI - Safety Risk37.71Risk Score14.5
Open Portuguese LLM - FaQuAD NLI25.51Macro F1 (%)4.9

Interactive version: theaggregate.ai/model?slug=longwriter-glm4-9b · How It Works · Data refreshed daily, snapshot 2026-09-19.