openbuddy-yi1.5-34B-v21.3-32k — benchmark results

OpenBuddy's multilingual chatbot fine-tune of Yi-1.5-34B-32K with a 32k-token context window. Provider: Other. Released 2024-06-05. Access: Open.

Unified ELO 1500 ± 18, rank #800 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic89.73Accuracy (%)91.2
Open Chinese LLM Leaderboard68.33Average Score (%)91.1
Open Chinese LLM - ARC Challenge61.18Accuracy (%)90.1
Open Chinese LLM - GSM8K64.29Accuracy (%)88.4
Open LLM Leaderboard - GPQA13.2Score87.4
Open Chinese LLM - WinoGrande68.19Accuracy (%)86.1
Open LLM Leaderboard - BBH45.64Score85.8
Open LLM Leaderboard - MMLU-Pro39.99Score85
Open Chinese LLM - HellaSwag67.34Accuracy (%)83.1
Open Chinese LLM - CMMLU69.05Accuracy (%)82.2
Open LLM Leaderboard - MuSR14.69Score79.8
Open Chinese LLM - TruthfulQA MC58.52Accuracy (%)77.4

Interactive version: theaggregate.ai/model?slug=openbuddy-yi1-5-34b-v21-3-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.