DeepSeek R1 Distill Qwen 32B — benchmark results

DeepSeek's official R1 reasoning distill onto Qwen2.5-32B (MIT license), SFT-trained on ~800K R1-generated reasoning traces. Provider: DeepSeek. Released 2025-01-20. Access: Open.

Unified ELO 1464 ± 10, rank #935 of 1776 rated models, from 349 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LogiQA 219.02CoT Gain (%)100
Open CoT Leaderboard16.92Average CoT Gain (%)99.2
Open CoT - LSAT Analytical Reasoning16.52CoT Gain (%)98.5
French LLM Leaderboard - GPQA FR54.4Score (%)98.1
Open CoT - LogiQA10.06CoT Gain (%)94.7
French LLM Leaderboard - Average53.39Average Score (%)94.4
French LLM Leaderboard - BAC FR45.62Score (%)94.4
Open CoT - LSAT Logical Reasoning20.39CoT Gain (%)93.9
Open Japanese LLM - Wiki NER SET F114.16Score (%)93.1
Open LLM Leaderboard - MMLU-Pro40.96Score85.8
Open LLM Leaderboard - MuSR16.14Score85
Open Japanese LLM - Jsts Pearson90.15Score (%)84.4

Interactive version: theaggregate.ai/model?slug=deepseek-r1-distill-qwen-32b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.