kollama-13B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1196 ± 19, rank #2632 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond26.77Normalized accuracy (%)88.9
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-Winogrande51.93Accuracy (%)8
Open Korean LLM - KorNAT-Helpful40.05Normalized accuracy (%)6.6
Open Korean LLM - Ko-GSM8K (flexible extract)0Exact match, flexible extract (%)2
Open Korean LLM - KorNAT-CKA8.41Normalized accuracy (%)1.2
Open Korean LLM - KorNAT-Harmless56.74Normalized accuracy (%)1
Open Korean LLM - Ko-IFEval0Strict accuracy, prompt/instruction mean (%)0.3
Open Ko-LLM Leaderboard23.82Average (%)0.1
Open Korean LLM Leaderboard23.82Average Score (%)0.1

Interactive version: theaggregate.ai/model?slug=kollama-13b · How It Works · Data refreshed daily, snapshot 2026-09-19.