Faro-Yi-9B-DPO — benchmark results

Wenbo Pan's DPO-tuned Faro-Yi-9B, a long-context Yi-9B derivative preference-trained on UltraFeedback, Orca, and Truthy DPO pairs. Provider: Other. Released 2024-04-07. Access: Open.

Unified ELO 1417 ± 24, rank #1142 of 1776 rated models, from 21 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LSAT Logical Reasoning18.24CoT Gain (%)85.9
Open CoT - LSAT Reading Comprehension19.7CoT Gain (%)84
Open Korean LLM Leaderboard464.51Average Score (%)83.8
Open CoT - LogiQA 212.91CoT Gain (%)83.2
Open Chinese LLM - WinoGrande66.69Accuracy (%)80
Open Chinese LLM - C-Eval Semantic86.22Accuracy (%)79.1
Open Chinese LLM Leaderboard63.94Average Score (%)77.7
Open Chinese LLM - ARC Challenge57.76Accuracy (%)76.6
Open Chinese LLM - HellaSwag64.24Accuracy (%)76
Open Chinese LLM - CMMLU63.5Accuracy (%)74.5
Open Chinese LLM - GSM8K53.37Accuracy (%)72.3
Open CoT Leaderboard10.8Average CoT Gain (%)70.2

Interactive version: theaggregate.ai/model?slug=faro-yi-9b-dpo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.