Qwen 1.5 32B — benchmark results
Alibaba's 32B mid-size addition to the open-weights Qwen1.5 series (April 2024), adding GQA and 32K context below the 72B tier. Provider: Alibaba. Released 2024-04-02. Access: Open.
Unified ELO 1480 ± 8, rank #873 of 1776 rated models, from 202 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Japanese LLM - Xlsum JA RougeLsum | 29.87 | Score (%) | 95.2 |
| Open Japanese LLM - Xlsum JA Bert Score JA F1 | 71.47 | Score (%) | 95 |
| Open Japanese LLM - Xlsum JA Rouge1 | 35.64 | Score (%) | 94.5 |
| Open Japanese LLM - SUM | 12.61 | Score (%) | 94 |
| Open Japanese LLM - Xlsum JA Rouge2 | 12.61 | Score (%) | 92.3 |
| HELM NaturalQuestions (Open) | 77.71 | F1 (%) | 90 |
| Open Chinese LLM - C-Eval Semantic | 88.88 | Accuracy (%) | 89.3 |
| Open Chinese LLM - GSM8K | 64.44 | Accuracy (%) | 88.7 |
| Open Chinese LLM - WinoGrande | 68.98 | Accuracy (%) | 88.7 |
| Open Chinese LLM - HellaSwag | 68.4 | Accuracy (%) | 87.4 |
| Open Chinese LLM Leaderboard | 66.63 | Average Score (%) | 84.9 |
| Open LLM Leaderboard - MMLU-Pro | 38.89 | Score | 83.7 |
Interactive version: theaggregate.ai/model?slug=qwen-1-5-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.