AISquare-Instruct-llama2-koen-13B-v0.9.14: benchmark results

Provider: Other. Access: Open.

Unified ELO 1409 ± 17, rank #1834 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande64.17Accuracy (%)77.4
Open Korean LLM - KorNAT-Helpful48.68Normalized accuracy (%)71.3
Open Korean LLM - KorNAT-Harmless63.69Normalized accuracy (%)65.7
Open Korean LLM Leaderboard34.08Average Score (%)46.2
Open Ko-LLM Leaderboard34.08Average (%)46
Open Korean LLM - Ko-IFEval27.52Strict accuracy, prompt/instruction mean (%)43.5
Open Korean LLM - KorNAT-CKA22.55Normalized accuracy (%)40.1
Open Korean LLM - Ko-GSM8K (flexible extract)10.77Exact match, flexible extract (%)35.1
Open Korean LLM - Ko-GPQA-Diamond19.7Normalized accuracy (%)9.6
Open Korean LLM - Ko-EQ-Bench-0.46EQ-Bench score4.8

Interactive version: theaggregate.ai/model?slug=aisquare-instruct-llama2-koen-13b-v0-9-14 · How It Works · Data refreshed daily, snapshot 2026-09-19.