KIT-7B-v3: benchmark results

Provider: Other. Access: Open.

Unified ELO 1278 ± 18, rank #2525 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-CKA27.91Normalized accuracy (%)72.6
Open Korean LLM - Ko-GPQA-Diamond23.74Normalized accuracy (%)55.6
Open Korean LLM - Ko-EQ-Bench0EQ-Bench score24.5
Open Korean LLM - Ko-IFEval20.8Strict accuracy, prompt/instruction mean (%)19.6
Open Korean LLM - KorNAT-Harmless59.64Normalized accuracy (%)7.9
Open Korean LLM - Ko-Winogrande51.78Accuracy (%)7.3
Open Korean LLM Leaderboard27.74Average Score (%)2.8
Open Ko-LLM Leaderboard27.74Average (%)2.7
Open Korean LLM - Ko-GSM8K (flexible extract)0Exact match, flexible extract (%)2
Open Korean LLM - KorNAT-Helpful36.38Normalized accuracy (%)1.8

Interactive version: theaggregate.ai/model?slug=kit-7b-v3 · How It Works · Data refreshed daily, snapshot 2026-09-19.