DeepSeek R1 Distill Llama 8B — benchmark results

Provider: DeepSeek. Released 2025-01-20. Access: Open.

Unified ELO 1351 ± 15, rank #1407 of 1776 rated models, from 241 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LogiQA13.26CoT Gain (%)99.2
Open CoT - LogiQA 218.26CoT Gain (%)98.5
Open CoT Leaderboard16.1Average CoT Gain (%)96.9
Open CoT - LSAT Reading Comprehension22.68CoT Gain (%)93.9
Open CoT - LSAT Analytical Reasoning8.26CoT Gain (%)89.3
Open CoT - LSAT Logical Reasoning18.04CoT Gain (%)84.7
FACTS Leaderboard40.68Combined Score (%)75.8
Open LLM Leaderboard - MATH Level 521.98Score74.5
HELM SeaHELM - Flores (id-en)56.47ChrF++65
Open FinLLM Reasoning - XBRL-Math81.11Accuracy (%)64
LatamBoard - Spanish PAWS60.95Score (%)60.6
Open Japanese LLM - Wiki NER SET F16.19Score (%)57.2

Interactive version: theaggregate.ai/model?slug=deepseek-r1-distill-llama-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.