k2s3_test_0000: benchmark results

Provider: Other. Access: Open.

Unified ELO 1353 ± 17, rank #2215 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Harmless64.72Normalized accuracy (%)76.6
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - KorNAT-CKA20.24Normalized accuracy (%)29.2
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-IFEval22.31Strict accuracy, prompt/instruction mean (%)23.2
Open Ko-LLM Leaderboard30.88Average (%)22.4
Open Korean LLM Leaderboard30.88Average Score (%)22.4
Open Korean LLM - KorNAT-Helpful43.05Normalized accuracy (%)21.3
Open Korean LLM - Ko-GSM8K (flexible extract)1.59Exact match, flexible extract (%)14.5
Open Korean LLM - Ko-Winogrande53.28Accuracy (%)12

Interactive version: theaggregate.ai/model?slug=k2s3-test-0000 · How It Works · Data refreshed daily, snapshot 2026-09-19.