Qwen-72B: benchmark results

Provider: Alibaba. Released 2023-11-26. Access: Open.

Unified ELO 1588 ± 30, rank #677 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
CFLUE72.8Accuracy100
Open Portuguese LLM - OAB Exams60.32Accuracy (%)92.6
Open Portuguese LLM - ENEM78.24Accuracy (%)91.9
Open Portuguese LLM - BLUEX68.43Accuracy (%)91.2
InfiBench55.34Score (%)85.7
Open Portuguese LLM - ASSIN2 RTE92.88Macro F1 (%)84.7
C-Eval82.8Average (%)83.8
Open Portuguese LLM - FaQuAD NLI78.4Macro F1 (%)83.7
T-Eval71.4Overall Score (%)80
pfgen-bench - Completion Mode - Helpfulness0.15Helpfulness Score56.9
pfgen-bench - Completion Mode - Fluency0.59Fluency Score55.6
pfgen-bench - Completion Mode - Score0.49pfgen Score (mean of three)53.7

Interactive version: theaggregate.ai/model?slug=qwen-72b · How It Works · Data refreshed daily, snapshot 2026-09-19.