llama3-open-ko-8B-shimshimi: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1410 ± 17, rank #1825 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA33.11Normalized accuracy (%)90.5
Open Korean LLM - Ko-GPQA-Diamond25.25Normalized accuracy (%)75.9
Open Korean LLM - KorNAT-Helpful47.1Normalized accuracy (%)53.1
Open Korean LLM - Ko-EQ-Bench5.27EQ-Bench score51
Open Korean LLM Leaderboard33.82Average Score (%)44.7
Open Ko-LLM Leaderboard33.82Average (%)44.4
Open Korean LLM - Ko-GSM8K (flexible extract)12.89Exact match, flexible extract (%)39.8
Open Korean LLM - Ko-IFEval25.87Strict accuracy, prompt/instruction mean (%)37
Open Korean LLM - Ko-Winogrande56.91Accuracy (%)28.5
Open Korean LLM - KorNAT-Harmless61.4Normalized accuracy (%)28

Interactive version: theaggregate.ai/model?slug=llama3-open-ko-8b-shimshimi · How It Works · Data refreshed daily, snapshot 2026-09-19.