llama3.1-korean-v1.3-sft-by-aidx: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1537 ± 17, rank #908 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA33.72Normalized accuracy (%)93
Open Korean LLM Leaderboard45.92Average Score (%)92.3
Open Ko-LLM Leaderboard45.92Average (%)92.2
Open Korean LLM - Ko-GSM8K (flexible extract)56.18Exact match, flexible extract (%)90.2
Open Korean LLM - Ko-EQ-Bench36.28EQ-Bench score86.4
Open Korean LLM - Ko-IFEval42.21Strict accuracy, prompt/instruction mean (%)85.9
Open Korean LLM - KorNAT-Helpful47.73Normalized accuracy (%)59.4
Open Korean LLM - Ko-Winogrande60.85Accuracy (%)58
Open Korean LLM - KorNAT-Harmless63.09Normalized accuracy (%)55.4
Open Korean LLM - Ko-GPQA-Diamond21.72Normalized accuracy (%)29.4

Interactive version: theaggregate.ai/model?slug=llama3-1-korean-v1-3-sft-by-aidx · How It Works · Data refreshed daily, snapshot 2026-09-19.