Faro-Yi-9B — benchmark results

wenbopan's bilingual English-Chinese fine-tune of Yi 9B 200K on the Fusang-V1 dataset, focused on practicality and long-context use. Provider: Other. Released 2024-03-27. Access: Open.

Unified ELO 1430 ± 20, rank #1088 of 1776 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic86.51Accuracy (%)80.1
Open Chinese LLM Leaderboard62.53Average Score (%)75.1
Open Chinese LLM - WinoGrande65.82Accuracy (%)74.8
Open Chinese LLM - CMMLU62.96Accuracy (%)72.4
Open Chinese LLM - GSM8K51.78Accuracy (%)70.8
Open Chinese LLM - HellaSwag62.64Accuracy (%)68.8
Open Chinese LLM - ARC Challenge55.12Accuracy (%)67.7
Open Korean LLM Leaderboard302.53Average Score (%)66.8
Open Chinese LLM - TruthfulQA MC52.85Accuracy (%)41.8

Interactive version: theaggregate.ai/model?slug=faro-yi-9b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.