DeepSeek-R1-Distill-Qwen-7B — benchmark results

Provider: DeepSeek. Released 2025-01-20. Access: Open.

Unified ELO 1320 ± 14, rank #1491 of 1776 rated models, from 212 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA Bleu JA75.15Score (%)99
Open CoT - LogiQA10.38CoT Gain (%)96.2
Open CoT - LSAT Reading Comprehension20.82CoT Gain (%)88.2
Open CoT - LogiQA 213.42CoT Gain (%)84
Open CoT Leaderboard12.6Average CoT Gain (%)84
Open CoT - LSAT Analytical Reasoning5.65CoT Gain (%)72.5
Open LLM Leaderboard - MATH Level 519.56Score70.2
Open CoT - LSAT Logical Reasoning12.75CoT Gain (%)62.2
Open-R1 Eval Leaderboard51.57Average Accuracy (%)61.1
LLM Stats (AIME 2024)83.3Score (%)60.4
LatamBoard - Spanish MGSM8.4Score (%)57.6
EuroEval English NLU - CoNLL EN68.1Named entity recognition Score (%)47.9

Interactive version: theaggregate.ai/model?slug=deepseek-r1-distill-qwen-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.