Faro-Yi-34B-DPO: benchmark results

Provider: Other. Released 2024-04-10. Access: Open.

Unified ELO 1598 ± 32, rank #635 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - WinoGrande71.82Accuracy (%)97.9
Open Chinese LLM - ARC Challenge62.2Accuracy (%)92.3
Open Chinese LLM - HellaSwag69.66Accuracy (%)92.3
Open Chinese LLM - C-Eval Semantic89.81Accuracy (%)91.8
Open Chinese LLM Leaderboard68.56Average Score (%)91.7
Open Chinese LLM - CMMLU70.84Accuracy (%)88.7
Open Portuguese LLM - OAB Exams55.85Accuracy (%)88.5
Open Portuguese LLM - BLUEX65.79Accuracy (%)87.3
Open Portuguese LLM - ENEM73.55Accuracy (%)85.3
Open Chinese LLM - GSM8K58.61Accuracy (%)81.3
Open Portuguese LLM - ASSIN2 RTE92.2Macro F1 (%)76
Open Chinese LLM - TruthfulQA MC56.99Accuracy (%)72.7

Interactive version: theaggregate.ai/model?slug=faro-yi-34b-dpo · How It Works · Data refreshed daily, snapshot 2026-09-19.