openbuddy-yi1.5-9B-v21.1-32k — benchmark results

OpenBuddy's multilingual chat fine-tune of Yi-1.5 9B with a 32K context window. Provider: Other. Released 2024-05-22. Access: Open.

Unified ELO 1464 ± 17, rank #938 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open CoT - LogiQA 214.69CoT Gain (%)90.1
Open CoT - LogiQA7.19CoT Gain (%)84.4
Open CoT - LSAT Reading Comprehension18.96CoT Gain (%)82.1
Open CoT Leaderboard11.77Average CoT Gain (%)77.9
Open Chinese LLM - GSM8K55.27Accuracy (%)75.7
Open Chinese LLM Leaderboard62.01Average Score (%)74.5
Open Chinese LLM - C-Eval Semantic83.1Accuracy (%)73.9
Open Chinese LLM - ARC Challenge56.06Accuracy (%)70.8
Open Chinese LLM - CMMLU60.06Accuracy (%)68.8
Open CoT - LSAT Logical Reasoning14.12CoT Gain (%)68.3
Open Chinese LLM - WinoGrande63.85Accuracy (%)61.9
Open Chinese LLM - HellaSwag60.87Accuracy (%)59.3

Interactive version: theaggregate.ai/model?slug=openbuddy-yi1-5-9b-v21-1-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.