suzume-llama-3-8B-multilingual — benchmark results

Lightblue's Suzume, a Llama 3 8B Instruct fine-tune on ~90K multilingual conversations to add non-English chat ability to Llama 3. Provider: Lightblue. Released 2024-05-01. Access: Open.

Unified ELO 1401 ± 11, rank #1219 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM Leaderboard521.74Average Score (%)89.6
Open Medical LLM - MMLU College Biology79.17Accuracy (%)80.7
Open LLM Leaderboard - IFEval66.78Score78.8
Open Medical LLM - MMLU College Medicine65.9Accuracy (%)75.3
Open Medical LLM - MMLU Anatomy65.93Accuracy (%)73.9
Open Medical LLM - MMLU Medical Genetics81Accuracy (%)71.6
Open Medical LLM - MedQA (USMLE)60.09Accuracy (%)70.7
Open Medical LLM - MedMCQA56.61Accuracy (%)69.3
Open Medical LLM69.3Average Accuracy (%)67.3
Open Medical LLM - MMLU Clinical Knowledge72.45Accuracy (%)62.5
Open Chinese LLM - WinoGrande63.54Accuracy (%)58.5
Open Medical LLM - MMLU Professional Medicine70.96Accuracy (%)58.2

Interactive version: theaggregate.ai/model?slug=suzume-llama-3-8b-multilingual · How the rankings work · Data refreshed daily, snapshot 2026-07-22.