suzume-llama-3-8B-multilingual-orpo-borda-top75 — benchmark results

Provider: Lightblue. Released 2024-04-26. Access: Open.

Unified ELO 1401 ± 18, rank #1221 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard514.52Average Score (%)88.7
Open LLM Leaderboard - IFEval66.87Score78.9
Open LLM Leaderboard - MMLU-Pro30.77Score63.6
Open Chinese LLM - HellaSwag60.67Accuracy (%)56.2
Open Chinese LLM - WinoGrande63.38Accuracy (%)55.8
Open Chinese LLM - GSM8K46.17Accuracy (%)52.7
Open Chinese LLM - CMMLU53.47Accuracy (%)50.6
Open LLM Leaderboard - BBH28.06Score45.4
Open Chinese LLM - C-Eval Semantic67.05Accuracy (%)42.1
Open Chinese LLM Leaderboard55.58Average Score (%)40.4
Open LLM Leaderboard - MATH Level 57.85Score40.4
Open Chinese LLM - ARC Challenge49.32Accuracy (%)38.6

Interactive version: theaggregate.ai/model?slug=suzume-llama-3-8b-multilingual-orpo-borda-top75 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.