Llama 3 70B Japanese Suzume Vector V0.1 — benchmark results

mmnga's experimental Japanese adaptation of Llama 3 70B Instruct, applying an upscaled chat vector from lightblue's Suzume 8B Japanese fine-tune. Provider: Meta. Released 2024-04-28. Access: Open.

Unified ELO 1463 ± 25, rank #943 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K70.58Accuracy (%)97.3
Open Chinese LLM - CMMLU72.14Accuracy (%)95
Open LLM Leaderboard - BBH50.02Score91.8
Open LLM Leaderboard - MMLU-Pro46.94Score90.6
Open Chinese LLM Leaderboard66.71Average Score (%)85.5
Open Chinese LLM - ARC Challenge59.56Accuracy (%)85.2
Open Chinese LLM - C-Eval Semantic86.75Accuracy (%)81.8
Open LLM Leaderboard - MATH Level 523.26Score76.7
Open Chinese LLM - HellaSwag62.95Accuracy (%)70.9
Open LLM Leaderboard - MuSR10.76Score54.7
Open LLM Leaderboard - IFEval46.49Score52.8
Open Chinese LLM - TruthfulQA MC53.1Accuracy (%)45.4

Interactive version: theaggregate.ai/model?slug=llama-3-70b-japanese-suzume-vector-v0-1 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.