Linkbricks-Horizon-AI-Korean-llama-3.1-sft-dpo-8B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1556 ± 17, rank #817 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-IFEval53.1Strict accuracy, prompt/instruction mean (%)95.7
Open Ko-LLM Leaderboard47.94Average (%)95.3
Open Korean LLM Leaderboard47.94Average Score (%)95.3
Open Korean LLM - Ko-GSM8K (flexible extract)61.56Exact match, flexible extract (%)95
Open Korean LLM - Ko-EQ-Bench37.17EQ-Bench score88
Open Korean LLM - KorNAT-CKA30.48Normalized accuracy (%)83.8
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Korean LLM - KorNAT-Harmless63.36Normalized accuracy (%)61.3
Open Korean LLM - Ko-Winogrande61.01Accuracy (%)59.2
Open Korean LLM - KorNAT-Helpful47.33Normalized accuracy (%)55.6

Interactive version: theaggregate.ai/model?slug=linkbricks-horizon-ai-korean-llama-3-1-sft-dpo-8b · How It Works · Data refreshed daily, snapshot 2026-09-19.