Qwen 3 32B — benchmark results
Alibaba Qwen 3 32B model row. Provider: Alibaba. Released 2025-04-28. Access: Open.
Unified ELO 1512 ± 9, rank #761 of 1776 rated models, from 414 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open-R1 Eval Leaderboard | 73.74 | Average Accuracy (%) | 100 |
| ChineseSafe Benchmark | 75.26 | Accuracy (%) | 96.3 |
| LLMZSZL Leaderboard | 66.84 | Score | 95.9 |
| YapBench | 730.2 | YapIndex (lower is better) | 95.1 |
| Turkish MMLU | 76 | Accuracy (%) | 93.8 |
| Active Evidence-Seeking and Diagnostic Reasoni | 48.3 | Task 2: Active Seeking Exact Accuracy (self-reported) | 92.9 |
| StakeBench | 17.6 | Agg (self-reported) | 92.9 |
| Open PL LLM - Generative | 68.1 | Average Generative Score (%) | 92.7 |
| EuroEval French Knowledge | 78.02 | Knowledge Average Score (%) | 92.4 |
| EuroEval Swedish Knowledge | 78.44 | Knowledge Average Score (%) | 92.3 |
| EuroEval Dutch | 70.31 | Average Score (%) | 90.6 |
| When Simulation Lies | 52.4 | Pert Acc (self-reported) | 90.5 |
Interactive version: theaggregate.ai/model?slug=qwen-3-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.