DeepSeek-Coder-7B-Instruct-v1.5: benchmark results
Provider: DeepSeek. Access: Open.
Unified ELO 1406 ± 19, rank #2083 of 2928 rated models, from 16 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EvoEval Combine | 24 | Pass@1 (%) | 86 |
| EvoEval Subtle | 66 | Pass@1 (%) | 85 |
| EvoEval Difficult | 37 | Pass@1 (%) | 81 |
| EvoEval | 53.23 | Pass@1 (%) | 78 |
| EvoEval Tool Use | 60 | Pass@1 (%) | 77 |
| EvoEval Concise | 67.68 | Pass@1 (%) | 75 |
| EvoEval Creative | 37 | Pass@1 (%) | 74 |
| EvalPlus (HumanEval+ & MBPP+) | 66.8 | Pass@1 avg (%) | 72.6 |
| EvoEval Verbose | 65.24 | Pass@1 (%) | 66 |
| Open LLM Leaderboard v1 - GSM8K | 20.39 | Accuracy (%) (5-shot) | 41.3 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 46.73 | MC2 (%) (0-shot) | 35.3 |
| FullStackBench en | 43.48 | Score (self-reported) | 30 |
Interactive version: theaggregate.ai/model?slug=deepseek-coder-7b-instruct-v1-5 · How It Works · Data refreshed daily, snapshot 2026-09-23.