QwQ 32B-Preview — benchmark results
Alibaba's experimental 32B reasoning preview that pioneered Qwen's long chain-of-thought approach ahead of the full QwQ-32B release (November 2024). Provider: Alibaba. Released 2024-11-27. Access: Open.
Unified ELO 1518 ± 23, rank #736 of 1776 rated models, from 115 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MMLU-Pro | 51.98 | Score | 99 |
| Open PL LLM - Multiple Choice | 65.26 | Average Multiple-Choice Score (%) | 99 |
| Open Japanese LLM - CG | 66.06 | Score (%) | 98.3 |
| Open PL LLM Leaderboard | 67.01 | Average Score (%) | 98.3 |
| Open Japanese LLM - RC | 92.54 | Score (%) | 96.3 |
| Open LLM Leaderboard - BBH | 53.39 | Score | 96.1 |
| Open Japanese LLM Leaderboard | 67.15 | Average Score (%) | 94.7 |
| Open PL LLM - Generative | 68.35 | Average Generative Score (%) | 94.4 |
| CodeElo | 1261 | Elo Rating | 94.1 |
| Open Japanese LLM - Jnli Exact Match | 89.65 | Score (%) | 93.9 |
| Open LLM Leaderboard - MATH Level 5 | 44.94 | Score | 93.3 |
| Open Persian LLM - ARC Challenge | 87.24 | Accuracy (%) | 93.3 |
Interactive version: theaggregate.ai/model?slug=qwq-32b-preview · How the rankings work · Data refreshed daily, snapshot 2026-07-22.