DeepSeek R1 Distill Qwen 1.5B: benchmark results
Provider: DeepSeek. Released 2025-01-20. Access: Open.
Unified ELO 1312 ± 1, rank #1333 of 1392 rated models, from 225 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 16.92 | Score | 65.3 |
| Open CoT - LSAT Analytical Reasoning | 4.78 | CoT Gain (%) | 63 |
| French LLM Leaderboard - BAC FR | 29.38 | Score (%) | 55.6 |
| Open CoT - LogiQA 2 | 6.49 | CoT Gain (%) | 48.9 |
| Open CoT - LSAT Reading Comprehension | 11.15 | CoT Gain (%) | 46.9 |
| Open CoT - LogiQA | 3.83 | CoT Gain (%) | 46.2 |
| Open CoT Leaderboard | 6.74 | Average CoT Gain (%) | 44.3 |
| MATH-Perturb (Hard) | 48.03 | Accuracy (%) | 41.7 |
| Open CoT - LSAT Logical Reasoning | 7.45 | CoT Gain (%) | 34.4 |
| Open-R1 Eval Leaderboard | 34.46 | Average Accuracy (%) | 33.3 |
| Open LLM Leaderboard - IFEval | 34.63 | Score | 33 |
| French LLM Leaderboard - Average | 27.51 | Average Score (%) | 29.6 |
Interactive version: theaggregate.ai/model?slug=deepseek-r1-distill-qwen-1-5b · How It Works · Data refreshed daily, snapshot 2026-09-05.