llama2_tmt-13B-v1: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1394 ± 17, rank #1956 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-Winogrande67.01Accuracy (%)90.3
Open Korean LLM - KorNAT-Harmless65.02Normalized accuracy (%)78.5
Open Korean LLM - KorNAT-CKA24.77Normalized accuracy (%)53.4
Open Korean LLM - Ko-EQ-Bench4.36EQ-Bench score50.5
Open Korean LLM - Ko-GSM8K (flexible extract)12.59Exact match, flexible extract (%)39.4
Open Korean LLM Leaderboard33.03Average Score (%)37.6
Open Ko-LLM Leaderboard33.03Average (%)37.3
Open Korean LLM - KorNAT-Helpful44.38Normalized accuracy (%)29.3
Open Korean LLM - Ko-IFEval17.18Strict accuracy, prompt/instruction mean (%)12.6
Open Korean LLM - Ko-GPQA-Diamond18.69Normalized accuracy (%)4.1

Interactive version: theaggregate.ai/model?slug=llama2-tmt-13b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-19.