Phind-CodeLlama-34B-v2: benchmark results

Provider: Other. Released 2023-08-28. Access: Open.

Unified ELO 1228 ± 14, rank #2602 of 2656 rated models, from 76 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
InfiBench59Score (%)94.3
EvoEval Verbose72.56Pass@1 (%)91
EvoEval Combine25Pass@1 (%)89
EffiBench - NMU1.89Normalized Memory Usage87.8
BigCode Models Leaderboard72HumanEval Python Pass@1 (%)84.7
EvoEval Concise70.73Pass@1 (%)84
MMLU-by-task - High School Statistics47.22Accuracy (%)83.4
EvoEval52.13Pass@1 (%)74
EvalPlus (HumanEval+ & MBPP+)67.1Pass@1 avg (%)73.4
EvoEval Subtle63Pass@1 (%)72
EvoEval Tool Use58Pass@1 (%)72
EvoEval Creative35Pass@1 (%)70

Interactive version: theaggregate.ai/model?slug=phind-codellama-34b-v2 · How It Works · Data refreshed daily, snapshot 2026-09-19.