Dear_My_best_Friend-SFT-v2-13B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1397 ± 17, rank #1937 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Helpful49.62Normalized accuracy (%)80.3
Open Korean LLM - Ko-Winogrande63.38Accuracy (%)73.8
Open Korean LLM - KorNAT-Harmless63.3Normalized accuracy (%)59.8
Open Korean LLM - Ko-GSM8K (flexible extract)15.24Exact match, flexible extract (%)44.6
Open Korean LLM Leaderboard33.23Average Score (%)39.8
Open Ko-LLM Leaderboard33.23Average (%)39.6
Open Korean LLM - KorNAT-CKA20.22Normalized accuracy (%)29.1
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-IFEval21.55Strict accuracy, prompt/instruction mean (%)21.5
Open Korean LLM - Ko-GPQA-Diamond18.69Normalized accuracy (%)4.1

Interactive version: theaggregate.ai/model?slug=dear-my-best-friend-sft-v2-13b · How It Works · Data refreshed daily, snapshot 2026-09-19.