DeepSeek-Coder-7B-Instruct-v1.5: benchmark results

Provider: DeepSeek. Access: Open.

Unified ELO 1406 ± 19, rank #2083 of 2928 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EvoEval Combine24Pass@1 (%)86
EvoEval Subtle66Pass@1 (%)85
EvoEval Difficult37Pass@1 (%)81
EvoEval53.23Pass@1 (%)78
EvoEval Tool Use60Pass@1 (%)77
EvoEval Concise67.68Pass@1 (%)75
EvoEval Creative37Pass@1 (%)74
EvalPlus (HumanEval+ & MBPP+)66.8Pass@1 avg (%)72.6
EvoEval Verbose65.24Pass@1 (%)66
Open LLM Leaderboard v1 - GSM8K20.39Accuracy (%) (5-shot)41.3
Open LLM Leaderboard v1 - TruthfulQA MC246.73MC2 (%) (0-shot)35.3
FullStackBench en43.48Score (self-reported)30

Interactive version: theaggregate.ai/model?slug=deepseek-coder-7b-instruct-v1-5 · How It Works · Data refreshed daily, snapshot 2026-09-23.