Smaug-Llama-3-70B-Instruct: benchmark results

Provider: Abacus.AI. Access: Open.

Unified ELO 1545 ± 1, rank #459 of 1392 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - CMMLU80.7Accuracy (%)100
Enkrypt AI - Toxicity Risk0Risk Score98.3
Open Chinese LLM - GSM8K70.05Accuracy (%)95.3
Open Chinese LLM Leaderboard68.14Average Score (%)89.8
Open Chinese LLM - C-Eval Semantic87.08Accuracy (%)83.4
Open Chinese LLM - ARC Challenge58.36Accuracy (%)80
Open Chinese LLM - HellaSwag64.73Accuracy (%)77.4
Enkrypt AI - Safety Risk22.2Risk Score72.9
Enkrypt AI - Jailbreak Risk5.53Risk Score71.9
Enkrypt AI - Bias Risk77.78Risk Score69.3
Open Chinese LLM - TruthfulQA MC53.91Accuracy (%)52.1
Enkrypt AI - Risk Score35.54Risk Score39.2

Interactive version: theaggregate.ai/model?slug=smaug-llama-3-70b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.