deepseek-llm-7B-base — benchmark results

DeepSeek LLM 7B base checkpoint. Provider: DeepSeek. Released 2023-11-29. Access: Open.

Unified ELO 1284 ± 25, rank #1569 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - HellaSwag61.91Accuracy (%)65
Open Chinese LLM - WinoGrande64.01Accuracy (%)63.4
Open LLM Leaderboard - GPQA3.13Score28.5
Open Chinese LLM - ARC Challenge47.1Accuracy (%)26.3
InfiBench25.34Score (%)21
Open LLM Leaderboard - BBH9.77Score19.8
Open LLM Leaderboard - MMLU-Pro8.96Score19.6
Open LLM Leaderboard - MuSR3.76Score18.1
Open LLM Leaderboard - IFEval21.79Score14.5
Open LLM Leaderboard - MATH Level 51.96Score13.8
Open Chinese LLM - GSM8K11.07Accuracy (%)9.5
Open Chinese LLM Leaderboard45.2Average Score (%)8.8

Interactive version: theaggregate.ai/model?slug=deepseek-llm-7b-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.