Meta-LLama-3-Cat-Smaug-LLama-70B — benchmark results

gbueno86's SLERP merge of Smaug Llama 3 70B Instruct with the Llama 3 Cat 70B roleplay tune. Provider: Other. Released 2024-05-24. Access: Open.

Unified ELO 1516 ± 29, rank #746 of 1776 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K72.93Accuracy (%)99.4
Open LLM Leaderboard - IFEval80.72Score98.2
Open Chinese LLM - CMMLU72.48Accuracy (%)96.7
Open LLM Leaderboard - BBH51.51Score94.5
Open Chinese LLM Leaderboard67.43Average Score (%)88.4
Open LLM Leaderboard - MMLU-Pro45.28Score88.3
Open Chinese LLM - ARC Challenge59.64Accuracy (%)85.6
Open Chinese LLM - C-Eval Semantic87.44Accuracy (%)85.3
Open LLM Leaderboard - MATH Level 529.38Score81.4
Open LLM Leaderboard - MuSR15Score81
Open LLM Leaderboard - GPQA10.29Score79.2
Open Chinese LLM - HellaSwag64.76Accuracy (%)77.7

Interactive version: theaggregate.ai/model?slug=meta-llama-3-cat-smaug-llama-70b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.