gemma-ko-7B-instruct-v0.71: benchmark results

Provider: Google. Access: API.

Unified ELO 1432 ± 17, rank #1649 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Korean LLM - Ko-EQ-Bench24.39EQ-Bench score69.8
Open Korean LLM - Ko-IFEval33.86Strict accuracy, prompt/instruction mean (%)69.1
Open Korean LLM - KorNAT-Harmless63.53Normalized accuracy (%)63.7
Open Korean LLM - KorNAT-CKA25.25Normalized accuracy (%)56.3
Open Korean LLM - Ko-GSM8K (flexible extract)23.2Exact match, flexible extract (%)56.1
Open Korean LLM Leaderboard35.76Average Score (%)53.7
Open Ko-LLM Leaderboard35.76Average (%)53.6
Open Korean LLM - KorNAT-Helpful43.2Normalized accuracy (%)22.1
Open Korean LLM - Ko-Winogrande52.88Accuracy (%)11.1

Interactive version: theaggregate.ai/model?slug=gemma-ko-7b-instruct-v0-71 · How It Works · Data refreshed daily, snapshot 2026-09-19.