suzume-llama-3-8B-multilingual-orpo-borda-full — benchmark results

Provider: Lightblue. Released 2024-04-25. Access: Open.

Unified ELO 1362 ± 23, rank #1373 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard413.04Average Score (%)78.6
Open LLM Leaderboard - IFEval58.17Score70
Open Chinese LLM - WinoGrande63.93Accuracy (%)62.6
Open Chinese LLM - HellaSwag60.66Accuracy (%)55.6
Open LLM Leaderboard - MMLU-Pro25.66Score46.4
Open Chinese LLM - C-Eval Semantic66.16Accuracy (%)40.1
Open LLM Leaderboard - MATH Level 57.63Score39.6
Open Chinese LLM - ARC Challenge49.49Accuracy (%)39.2
Open LLM Leaderboard - BBH25.08Score38.3
Open Chinese LLM - CMMLU51.04Accuracy (%)37.7
Open Chinese LLM - TruthfulQA MC52.17Accuracy (%)35
Open Chinese LLM Leaderboard53.65Average Score (%)31.5

Interactive version: theaggregate.ai/model?slug=suzume-llama-3-8b-multilingual-orpo-borda-full · How the rankings work · Data refreshed daily, snapshot 2026-07-22.