SwallowMaid-8B-L3-SPPO-abliterated: benchmark results

Provider: Other. Access: Open.

Unified ELO 1491 ± 17, rank #1167 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GSM8K (flexible extract)57.77Exact match, flexible extract (%)92
Open Korean LLM - Ko-IFEval42.59Strict accuracy, prompt/instruction mean (%)86.4
Open Korean LLM - Ko-EQ-Bench31.86EQ-Bench score81
Open Portuguese LLM - ENEM71.17Accuracy (%)79.3
Open Korean LLM Leaderboard40.87Average Score (%)79
Open Ko-LLM Leaderboard40.87Average (%)78.9
Open Portuguese LLM - OAB Exams49.98Accuracy (%)75.4
Open Portuguese LLM - BLUEX58.83Accuracy (%)74.9
Open Portuguese LLM - ASSIN2 RTE91.28Macro F1 (%)65.8
Open Korean LLM - Ko-GPQA-Diamond24.24Normalized accuracy (%)62.4
Open Korean LLM - Ko-Winogrande60.85Accuracy (%)58
Open Korean LLM - KorNAT-Helpful47.6Normalized accuracy (%)57.8

Interactive version: theaggregate.ai/model?slug=swallowmaid-8b-l3-sppo-abliterated · How It Works · Data refreshed daily, snapshot 2026-09-19.