Alpaca_QLoRA_test: benchmark results

Provider: Other. Access: Open.

Unified ELO 1451 ± 17, rank #1517 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - KorNAT-Helpful51.23Normalized accuracy (%)89.4
Open Korean LLM - Ko-GPQA-Diamond26.26Normalized accuracy (%)85.5
Open Korean LLM - KorNAT-Harmless66.1Normalized accuracy (%)84.5
Open Korean LLM - Ko-IFEval39.39Strict accuracy, prompt/instruction mean (%)80.9
Open Korean LLM - Ko-EQ-Bench24.23EQ-Bench score69.7
Open Ko-LLM Leaderboard37.53Average (%)62.8
Open Korean LLM Leaderboard37.53Average Score (%)62.8
Open Korean LLM - Ko-GSM8K (flexible extract)23.43Exact match, flexible extract (%)56.4
Open Korean LLM - Ko-Winogrande55.96Accuracy (%)23.7
Open Korean LLM - KorNAT-CKA18.84Normalized accuracy (%)20.7

Interactive version: theaggregate.ai/model?slug=alpaca-qlora-test · How It Works · Data refreshed daily, snapshot 2026-09-19.