suzume-llama-3-8B-multilingual-orpo-borda-half: benchmark results

Provider: Lightblue. Released 2024-04-25. Access: Open.

Unified ELO 1461 ± 1, rank #894 of 1392 rated models, from 16 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard45.06Average Score (%)91
Open LLM Leaderboard - IFEval62.49Score74.5
Open Chinese LLM - GSM8K49.05Accuracy (%)63.9
Ru Arena Hard57.13Win Rate (%)56.3
Open Chinese LLM - WinoGrande63.38Accuracy (%)55.8
Open LLM Leaderboard - MMLU-Pro29.04Score55.4
Open Chinese LLM - CMMLU53.6Accuracy (%)51.6
Open Chinese LLM - HellaSwag59.81Accuracy (%)48.1
Open Chinese LLM - C-Eval Semantic68.59Accuracy (%)46.4
Open LLM Leaderboard - MATH Level 59.06Score44.4
Open Chinese LLM Leaderboard56.01Average Score (%)43.6
Open LLM Leaderboard - BBH26.35Score41.1

Interactive version: theaggregate.ai/model?slug=suzume-llama-3-8b-multilingual-orpo-borda-half · How It Works · Data refreshed daily, snapshot 2026-09-05.