code-millenials-34B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1396 ± 20, rank #2174 of 2928 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EvoEval Verbose74.39Pass@1 (%)94
EvoEval Concise71.34Pass@1 (%)86
EvoEval54.11Pass@1 (%)84
EvoEval Creative41Pass@1 (%)81
EvoEval Subtle65Pass@1 (%)80
EvoEval Difficult35Pass@1 (%)78
EvalPlus (HumanEval+ & MBPP+)67.7Pass@1 avg (%)75
EvoEval Tool Use56Pass@1 (%)66
EvoEval Combine17Pass@1 (%)65
Open LLM Leaderboard v1 - GSM8K32.45Accuracy (%) (5-shot)48.9
Open LLM Leaderboard v1 - TruthfulQA MC245.37MC2 (%) (0-shot)30.6
Open LLM Leaderboard v1 - MMLU49.28Accuracy (%) (5-shot)28.5

Interactive version: theaggregate.ai/model?slug=code-millenials-34b · How It Works · Data refreshed daily, snapshot 2026-09-23.