Smaug-Llama-3-70B-Instruct: benchmark results
Provider: Abacus.AI. Access: Open.
Unified ELO 1545 ± 1, rank #459 of 1392 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Chinese LLM - CMMLU | 80.7 | Accuracy (%) | 100 |
| Enkrypt AI - Toxicity Risk | 0 | Risk Score | 98.3 |
| Open Chinese LLM - GSM8K | 70.05 | Accuracy (%) | 95.3 |
| Open Chinese LLM Leaderboard | 68.14 | Average Score (%) | 89.8 |
| Open Chinese LLM - C-Eval Semantic | 87.08 | Accuracy (%) | 83.4 |
| Open Chinese LLM - ARC Challenge | 58.36 | Accuracy (%) | 80 |
| Open Chinese LLM - HellaSwag | 64.73 | Accuracy (%) | 77.4 |
| Enkrypt AI - Safety Risk | 22.2 | Risk Score | 72.9 |
| Enkrypt AI - Jailbreak Risk | 5.53 | Risk Score | 71.9 |
| Enkrypt AI - Bias Risk | 77.78 | Risk Score | 69.3 |
| Open Chinese LLM - TruthfulQA MC | 53.91 | Accuracy (%) | 52.1 |
| Enkrypt AI - Risk Score | 35.54 | Risk Score | 39.2 |
Interactive version: theaggregate.ai/model?slug=smaug-llama-3-70b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-05.