Llama 3 70B Synthia V3.5 — benchmark results

Migel Tissera's uncensored general-assistant fine-tune of Llama 3 70B on the Synthia v3.5 varied-system-context dataset. Provider: Meta. Released 2024-05-26. Access: Open.

Unified ELO 1522 ± 24, rank #714 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR23.39Score98.3
Open Chinese LLM - CMMLU73.46Accuracy (%)97.6
Open LLM Leaderboard - GPQA18.34Score96.8
Open Chinese LLM - GSM8K69.14Accuracy (%)93.8
Open Chinese LLM Leaderboard68.58Average Score (%)92
Open LLM Leaderboard - BBH49.12Score89.8
Open Chinese LLM - HellaSwag68.46Accuracy (%)87.8
Open Chinese LLM - ARC Challenge59.9Accuracy (%)86.8
Open LLM Leaderboard - MMLU-Pro40.65Score85.6
Open Chinese LLM - WinoGrande67.96Accuracy (%)85.5
Open Chinese LLM - C-Eval Semantic87.41Accuracy (%)84.9
Open LLM Leaderboard - MATH Level 521.15Score72.9

Interactive version: theaggregate.ai/model?slug=llama-3-70b-synthia-v3-5 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.