Meta-LLama-3-Cat-Smaug-LLama-70B: benchmark results

gbueno86's SLERP merge of Smaug Llama 3 70B Instruct with the Llama 3 Cat 70B roleplay tune. Provider: Other. Released 2024-05-24. Access: Open.

Unified ELO 1596 ± 1, rank #274 of 1392 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - GSM8K72.93Accuracy (%)99.4
Open LLM Leaderboard - IFEval80.72Score98.2
Open Chinese LLM - CMMLU72.48Accuracy (%)96.7
Open LLM Leaderboard - BBH51.51Score94.5
Open Chinese LLM Leaderboard67.43Average Score (%)88.4
Open LLM Leaderboard - MMLU-Pro45.28Score88.3
Open Chinese LLM - ARC Challenge59.64Accuracy (%)85.6
Open Chinese LLM - C-Eval Semantic87.44Accuracy (%)85.3
Open LLM Leaderboard - MATH Level 529.38Score81.4
Open LLM Leaderboard - MuSR15Score81
Open LLM Leaderboard - GPQA10.29Score79.2
Open Chinese LLM - HellaSwag64.76Accuracy (%)77.7

Interactive version: theaggregate.ai/model?slug=meta-llama-3-cat-smaug-llama-70b · How It Works · Data refreshed daily, snapshot 2026-09-05.