Smaug-Llama-3-70B-Instruct-32K — benchmark results

Abacus.AI's Smaug fine-tune of Llama 3 70B Instruct with context extended to 32K via PoSE training. Provider: Other. Released 2024-06-11. Access: Open.

Unified ELO 1491 ± 27, rank #837 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - IFEval77.61Score93.5
Open Chinese LLM - CMMLU71.66Accuracy (%)93.2
Open Chinese LLM - GSM8K68.08Accuracy (%)92.6
Open LLM Leaderboard - BBH49.07Score89.7
Open LLM Leaderboard - MMLU-Pro41.83Score86.5
Open Chinese LLM Leaderboard66.05Average Score (%)82.5
Open LLM Leaderboard - MATH Level 527.49Score79.7
Open Chinese LLM - C-Eval Semantic86.22Accuracy (%)79.1
Open Chinese LLM - ARC Challenge57.94Accuracy (%)77.9
Open Chinese LLM - HellaSwag63.79Accuracy (%)74.5
Open LLM Leaderboard - MuSR12.43Score67.8
Open LLM Leaderboard - GPQA6.15Score51.6

Interactive version: theaggregate.ai/model?slug=smaug-llama-3-70b-instruct-32k · How the rankings work · Data refreshed daily, snapshot 2026-07-22.