Qwen 2 72B — benchmark results

Alibaba's open 72B flagship of the 2024 Qwen2 series, with a 128K context via YaRN. Provider: Alibaba. Released 2024-06-10. Access: Open.

Unified ELO 1576 ± 10, rank #543 of 1776 rated models, from 157 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
OpenEvals - GSM8K89.5Accuracy (%)100
RABBITS B4B83.72Accuracy (%)100
Open Chinese LLM - C-Eval Semantic93.47Accuracy (%)99.7
Open Chinese LLM - CMMLU78.66Accuracy (%)99.7
Open Chinese LLM - GSM8K75.36Accuracy (%)99.7
Open LLM Leaderboard - MMLU-Pro52.56Score99.2
Open Arabic LLM - Arabic MMLU HT Global Facts54Accuracy (%)98.8
Open LLM Leaderboard - GPQA19.24Score98.4
Open Chinese LLM Leaderboard72.66Average Score (%)97.9
Open Arabic LLM - Arabic MMLU HT US Foreign Policy87Accuracy (%)97.5
Open Chinese LLM - HellaSwag73.26Accuracy (%)97.3
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task96Accuracy (%)97.2

Interactive version: theaggregate.ai/model?slug=qwen-2-72b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.