Qwen 3 32B — benchmark results

Alibaba Qwen 3 32B model row. Provider: Alibaba. Released 2025-04-28. Access: Open.

Unified ELO 1512 ± 9, rank #761 of 1776 rated models, from 414 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open-R1 Eval Leaderboard73.74Average Accuracy (%)100
ChineseSafe Benchmark75.26Accuracy (%)96.3
LLMZSZL Leaderboard66.84Score95.9
YapBench730.2YapIndex (lower is better)95.1
Turkish MMLU76Accuracy (%)93.8
Active Evidence-Seeking and Diagnostic Reasoni48.3Task 2: Active Seeking Exact Accuracy (self-reported)92.9
StakeBench17.6Agg (self-reported)92.9
Open PL LLM - Generative68.1Average Generative Score (%)92.7
EuroEval French Knowledge78.02Knowledge Average Score (%)92.4
EuroEval Swedish Knowledge78.44Knowledge Average Score (%)92.3
EuroEval Dutch70.31Average Score (%)90.6
When Simulation Lies52.4Pert Acc (self-reported)90.5

Interactive version: theaggregate.ai/model?slug=qwen-3-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.