deepseek-llm-7B-base: benchmark results

DeepSeek LLM 7B base checkpoint. Provider: DeepSeek. Released 2023-11-29. Access: Open.

Unified ELO 1304 ± 1, rank #1343 of 1392 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - HellaSwag61.91Accuracy (%)65
Open Chinese LLM - WinoGrande64.01Accuracy (%)63.4
Open LLM Leaderboard - GPQA3.13Score28.5
Open Chinese LLM - ARC Challenge47.1Accuracy (%)26.3
Open LLM Leaderboard - BBH9.77Score19.8
Open LLM Leaderboard - MMLU-Pro8.96Score19.6
Open LLM Leaderboard - MuSR3.76Score18.1
Open LLM Leaderboard - IFEval21.79Score14.5
Open LLM Leaderboard - MATH Level 51.96Score13.8
Open Chinese LLM - GSM8K11.07Accuracy (%)9.5
Open Chinese LLM Leaderboard45.2Average Score (%)8.8
Open Chinese LLM - CMMLU43.12Accuracy (%)8.6

Interactive version: theaggregate.ai/model?slug=deepseek-llm-7b-base · How It Works · Data refreshed daily, snapshot 2026-09-05.