Qwen 1.5 72B — benchmark results

72B base model of Alibaba's open-weights Qwen1.5 series (February 2024), a multilingual release with 32K context. Provider: Alibaba. Released 2024-02-05. Access: Open.

Unified ELO 1484 ± 17, rank #861 of 1776 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - HellaSwag70.33Accuracy (%)94.1
Open Chinese LLM - C-Eval Semantic90.13Accuracy (%)93.5
Open Chinese LLM - GSM8K65.28Accuracy (%)89.9
Open Chinese LLM Leaderboard68.14Average Score (%)89.8
Open Chinese LLM - WinoGrande68.82Accuracy (%)87.8
Open Chinese LLM - CMMLU70.52Accuracy (%)87.2
Open PL LLM - Multiple Choice59.87Average Multiple-Choice Score (%)86
HELM NaturalQuestions (Open)75.85F1 (%)81.1
Open Chinese LLM - ARC Challenge58.36Accuracy (%)80
CMMLU83.545-shot Avg Accuracy (%)77.5
Open PL LLM Leaderboard61.11Average Score (%)77.3
Open PL LLM - Generative62.06Average Generative Score (%)75.2

Interactive version: theaggregate.ai/model?slug=qwen-1-5-72b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.