WizardCoder-15B-V1.0: benchmark results

Provider: Other. Access: Open.

Unified ELO 1197 ± 12, rank #1526 of 1605 rated models, from 80 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Abstract Algebra34Accuracy (%)82
EffiBench - NET2.84Normalized Execution Time81.7
MMLU-by-task - College Mathematics36Accuracy (%)80.3
BigCode Models Leaderboard58.1HumanEval Python Pass@1 (%)74.6
MMLU-by-task - High School Mathematics28.15Accuracy (%)61.7
InfiBench41.01Score (%)60
EffiBench - NMU1.91Normalized Memory Usage58.5
MMLU-by-task - Econometrics28.95Accuracy (%)55
MMLU-by-task - College Physics25.49Accuracy (%)53.3
EvalPlus (HumanEval+ & MBPP+)52.4Pass@1 avg (%)48.8
MMLU-by-task - Elementary Mathematics28.31Accuracy (%)47.7
CodeEditorBench Plus - Code Requirement Switch (Zero-shot)6.7pass@1 (%, greedy decoding, zero-shot, CodeEditorBench_Plus)44.4

Interactive version: theaggregate.ai/model?slug=wizardcoder-15b-v1-0 · How It Works · Data refreshed daily, snapshot 2026-09-26.