Yi 34B (Chat) — benchmark results
Provider: 01.AI. Released 2023-11-02. Access: Open.
Unified ELO 1392 ± 24, rank #1262 of 1776 rated models, from 60 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| JustEval | 4.87 | Avg Score (1-5) | 100 |
| JustEval - Depth | 4.79 | Score (1-5) | 100 |
| JustEval - Engagement | 4.85 | Score (1-5) | 96.7 |
| EffiBench - NET | 2.77 | Normalized Execution Time | 92.7 |
| JustEval - Helpfulness | 4.86 | Score (1-5) | 90 |
| AlpacaEval 1.0 | 94.08 | Win Rate (%) | 89.1 |
| EffiBench - NMU | 1.89 | Normalized Memory Usage | 87.8 |
| Open Korean LLM Leaderboard | 492.59 | Average Score (%) | 86.6 |
| Open Chinese LLM - C-Eval Semantic | 87.4 | Accuracy (%) | 84.6 |
| Open LLM Leaderboard - GPQA | 11.74 | Score | 83.7 |
| Big-Bench Hard | 71.7 | Average (%) | 82.3 |
| Open Chinese LLM - ARC Challenge | 58.62 | Accuracy (%) | 81.5 |
Interactive version: theaggregate.ai/model?slug=yi-34b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.