Phind-CodeLlama-34B-v1: benchmark results

Provider: Other. Access: Open.

Unified ELO 1352 ± 30, rank #2470 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
InfiBench58.47Score (%)93.3
EffiBench - NMU1.9Normalized Memory Usage79.3
BigCode Models Leaderboard65.8HumanEval Python Pass@1 (%)78
EffiBench - NET2.91Normalized Execution Time67.1
Open LLM Leaderboard v1 - GSM8K20.47Accuracy (%) (5-shot)41.3
Open LLM Leaderboard v1 - WinoGrande72.61Accuracy (%) (5-shot)29.5
Open LLM Leaderboard v1 - TruthfulQA MC244.94MC2 (%) (0-shot)29.1
Open LLM Leaderboard v1 - MMLU28.94Accuracy (%) (5-shot)16.2
Open LLM Leaderboard v1 - ARC Challenge27.13Normalized accuracy (%) (25-shot)6.3
Open LLM Leaderboard v1 - HellaSwag28.28Normalized accuracy (%) (10-shot)4.7

Interactive version: theaggregate.ai/model?slug=phind-codellama-34b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.