code-millenials-34B: benchmark results
Provider: Other. Access: Open.
Unified ELO 1396 ± 20, rank #2174 of 2928 rated models, from 15 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EvoEval Verbose | 74.39 | Pass@1 (%) | 94 |
| EvoEval Concise | 71.34 | Pass@1 (%) | 86 |
| EvoEval | 54.11 | Pass@1 (%) | 84 |
| EvoEval Creative | 41 | Pass@1 (%) | 81 |
| EvoEval Subtle | 65 | Pass@1 (%) | 80 |
| EvoEval Difficult | 35 | Pass@1 (%) | 78 |
| EvalPlus (HumanEval+ & MBPP+) | 67.7 | Pass@1 avg (%) | 75 |
| EvoEval Tool Use | 56 | Pass@1 (%) | 66 |
| EvoEval Combine | 17 | Pass@1 (%) | 65 |
| Open LLM Leaderboard v1 - GSM8K | 32.45 | Accuracy (%) (5-shot) | 48.9 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 45.37 | MC2 (%) (0-shot) | 30.6 |
| Open LLM Leaderboard v1 - MMLU | 49.28 | Accuracy (%) (5-shot) | 28.5 |
Interactive version: theaggregate.ai/model?slug=code-millenials-34b · How It Works · Data refreshed daily, snapshot 2026-09-23.