DeepSeek-R1-ReDistill-Llama3-8B-v1.1 — benchmark results

Provider: DeepSeek. Released 2025-01-29. Access: Open.

Unified ELO 1331 ± 13, rank #1471 of 1776 rated models, from 179 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 532.85Score83.7
Open Japanese LLM - Wiki NER SET F15.31Score (%)51.2
Open LLM Leaderboard - IFEval37.04Score36
Open Japanese LLM - Wiki PAS SET F14.72Score (%)34.1
Open Japanese LLM - Jsem Exact Match72.66Score (%)33.7
Open Japanese LLM - Jnli Exact Match72.93Score (%)33.4
Open Arabic LLM - Arabic MMLU HT Econometrics26.32Accuracy (%)32.7
Open Japanese LLM - Xlsum JA Bert Score JA F167.61Score (%)31.5
Open Japanese LLM - Wikicorpus J TO E Bert Score EN F188.88Score (%)30.5
Open Japanese LLM - CG0.4Score (%)30
Open Japanese LLM - Jamp Exact Match50.86Score (%)29.9
Open Arabic LLM - Arabic MMLU HT Abstract Algebra25Accuracy (%)29.6

Interactive version: theaggregate.ai/model?slug=deepseek-r1-redistill-llama3-8b-v1-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.