Faro-Yi-9B: benchmark results

wenbopan's bilingual English-Chinese fine-tune of Yi 9B 200K on the Fusang-V1 dataset, focused on practicality and long-context use. Provider: Other. Released 2024-03-27. Access: Open.

Unified ELO 1494 ± 1, rank #720 of 1392 rated models, from 9 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic86.51Accuracy (%)80.1
Open Chinese LLM Leaderboard62.53Average Score (%)75.1
Open Chinese LLM - WinoGrande65.82Accuracy (%)74.8
Open Chinese LLM - CMMLU62.96Accuracy (%)72.4
Open Chinese LLM - GSM8K51.78Accuracy (%)70.8
Open Chinese LLM - HellaSwag62.64Accuracy (%)68.8
Open Chinese LLM - ARC Challenge55.12Accuracy (%)67.7
Open Korean LLM Leaderboard36.57Average Score (%)54.8
Open Chinese LLM - TruthfulQA MC52.85Accuracy (%)41.8

Interactive version: theaggregate.ai/model?slug=faro-yi-9b · How It Works · Data refreshed daily, snapshot 2026-09-05.