naps-llama-3-1-instruct-v0.5.1: benchmark results

Provider: Other. Access: Open.

Unified ELO 1459 ± 17, rank #1462 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-GSM8K (flexible extract)44.73Exact match, flexible extract (%)79.8
Open Korean LLM - Ko-IFEval35.46Strict accuracy, prompt/instruction mean (%)72.9
Open Korean LLM Leaderboard38.74Average Score (%)68.4
Open Ko-LLM Leaderboard38.74Average (%)68.3
Open Korean LLM - KorNAT-Helpful48.45Normalized accuracy (%)68.1
Open Korean LLM - Ko-EQ-Bench15.84EQ-Bench score61.2
Open Korean LLM - Ko-Winogrande59.19Accuracy (%)44.4
Open Korean LLM - Ko-GPQA-Diamond22.73Normalized accuracy (%)40.9
Open Korean LLM - KorNAT-Harmless61.77Normalized accuracy (%)33.7
Open Korean LLM - KorNAT-CKA19.92Normalized accuracy (%)27.3

Interactive version: theaggregate.ai/model?slug=naps-llama-3-1-instruct-v0-5-1 · How It Works · Data refreshed daily, snapshot 2026-09-19.