DeepSeek R1 Distill Llama 8B: benchmark results

Provider: DeepSeek. Released 2025-01-20. Access: Open.

Unified ELO 1397 ± 1, rank #1145 of 1392 rated models, from 269 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LogiQA13.26CoT Gain (%)99.2
Open CoT - LogiQA 218.26CoT Gain (%)98.5
Open CoT Leaderboard16.1Average CoT Gain (%)96.9
Open CoT - LSAT Reading Comprehension22.68CoT Gain (%)93.9
Open CoT - LSAT Analytical Reasoning8.26CoT Gain (%)89.3
Open CoT - LSAT Logical Reasoning18.04CoT Gain (%)84.7
FACTS Leaderboard40.68Combined Score (%)75.8
Open LLM Leaderboard - MATH Level 521.98Score74.5
Enkrypt AI - Toxicity Risk1.91Risk Score70.2
HELM SeaHELM - Flores (id-en)56.47ChrF++65
Open FinLLM Reasoning - XBRL-Math81.11Accuracy (%)64
LatamBoard - Spanish PAWS60.95Score (%)60.6

Interactive version: theaggregate.ai/model?slug=deepseek-r1-distill-llama-8b · How It Works · Data refreshed daily, snapshot 2026-09-05.