Qwen 1.5 32B — benchmark results

Alibaba's 32B mid-size addition to the open-weights Qwen1.5 series (April 2024), adding GQA and 32K context below the 72B tier. Provider: Alibaba. Released 2024-04-02. Access: Open.

Unified ELO 1480 ± 8, rank #873 of 1776 rated models, from 202 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA RougeLsum29.87Score (%)95.2
Open Japanese LLM - Xlsum JA Bert Score JA F171.47Score (%)95
Open Japanese LLM - Xlsum JA Rouge135.64Score (%)94.5
Open Japanese LLM - SUM12.61Score (%)94
Open Japanese LLM - Xlsum JA Rouge212.61Score (%)92.3
HELM NaturalQuestions (Open)77.71F1 (%)90
Open Chinese LLM - C-Eval Semantic88.88Accuracy (%)89.3
Open Chinese LLM - GSM8K64.44Accuracy (%)88.7
Open Chinese LLM - WinoGrande68.98Accuracy (%)88.7
Open Chinese LLM - HellaSwag68.4Accuracy (%)87.4
Open Chinese LLM Leaderboard66.63Average Score (%)84.9
Open LLM Leaderboard - MMLU-Pro38.89Score83.7

Interactive version: theaggregate.ai/model?slug=qwen-1-5-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.