Yi-Coder-9B-Chat — benchmark results

Provider: 01.AI. Released 2024-08-21. Access: Open.

Unified ELO 1337 ± 26, rank #1448 of 1776 rated models, from 19 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval48.17Score56.2
Open Korean LLM Leaderboard158.7Average Score (%)55.7
BigCodeBench38.1Pass@1 (%)49.6
CodeElo296Elo Rating44.1
FullStackBench en47.13Score (self-reported)40.7
Open LLM Leaderboard - BBH25.94Score40.2
Open LLM Leaderboard - MuSR7.96Score37.3
Open Chinese LLM - C-Eval Semantic63.61Accuracy (%)34.4
Open Chinese LLM - GSM8K32.75Accuracy (%)28.2
Open LLM Leaderboard - MMLU-Pro15.84Score24.9
Open LLM Leaderboard - MATH Level 54Score23
Open Chinese LLM - HellaSwag54.4Accuracy (%)21.1

Interactive version: theaggregate.ai/model?slug=yi-coder-9b-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.