suzume-llama-3-8B-multilingual-orpo-borda-half — benchmark results

Provider: Lightblue. Released 2024-04-25. Access: Open.

Unified ELO 1369 ± 39, rank #1348 of 1776 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard596.36Average Score (%)93.6
Open LLM Leaderboard - IFEval62.49Score74.5
Open Chinese LLM - GSM8K49.05Accuracy (%)63.9
Ru Arena Hard57.13Win Rate (%)56.3
Open Chinese LLM - WinoGrande63.38Accuracy (%)55.8
Open LLM Leaderboard - MMLU-Pro29.04Score55.4
Open Chinese LLM - CMMLU53.6Accuracy (%)51.6
Open Chinese LLM - HellaSwag59.81Accuracy (%)48.1
Open Chinese LLM - C-Eval Semantic68.59Accuracy (%)46.4
Open LLM Leaderboard - MATH Level 59.06Score44.4
Open Chinese LLM Leaderboard56.01Average Score (%)43.6
Open LLM Leaderboard - BBH26.35Score41.1

Interactive version: theaggregate.ai/model?slug=suzume-llama-3-8b-multilingual-orpo-borda-half · How the rankings work · Data refreshed daily, snapshot 2026-07-22.