Smaug-34B-v0.1-ExPO: benchmark results

Provider: Abacus.AI. Released 2024-05-29. Access: Open.

Unified ELO 1587 ± 33, rank #685 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - C-Eval Semantic90.85Accuracy (%)97.6
Open Chinese LLM - WinoGrande70.56Accuracy (%)94.2
Open Chinese LLM - TruthfulQA MC62.67Accuracy (%)92
Open Chinese LLM - ARC Challenge60.24Accuracy (%)87.7
Open Chinese LLM Leaderboard67.1Average Score (%)86.9
Open Chinese LLM - CMMLU69.37Accuracy (%)82.5
Open Portuguese LLM - BLUEX62.17Accuracy (%)81.8
Open Portuguese LLM - OAB Exams51.57Accuracy (%)80.6
Open Chinese LLM - GSM8K53.9Accuracy (%)73.7
Open Portuguese LLM - FaQuAD NLI75.39Macro F1 (%)73.6
Open Portuguese LLM - ENEM69.42Accuracy (%)73.2
Open Portuguese LLM - ASSIN2 RTE91.58Macro F1 (%)68.5

Interactive version: theaggregate.ai/model?slug=smaug-34b-v0-1-expo · How It Works · Data refreshed daily, snapshot 2026-09-19.