llama3-deepspeed-v1.0: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1481 ± 17, rank #1275 of 2656 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Korean LLM - Ko-IFEval44.49Strict accuracy, prompt/instruction mean (%)88.9
Open Korean LLM - Ko-GPQA-Diamond25.76Normalized accuracy (%)81.3
Open Korean LLM Leaderboard40.48Average Score (%)77.3
Open Ko-LLM Leaderboard40.48Average (%)77.2
Open Korean LLM - Ko-GSM8K (flexible extract)39.73Exact match, flexible extract (%)74
Open Korean LLM - KorNAT-Helpful48.15Normalized accuracy (%)65.1
Open Korean LLM - Ko-EQ-Bench16.57EQ-Bench score61.9
Open Korean LLM - KorNAT-CKA25.38Normalized accuracy (%)57.6
Open Korean LLM - Ko-Winogrande60.06Accuracy (%)51.1
Open Korean LLM - KorNAT-Harmless62.01Normalized accuracy (%)36.9

Interactive version: theaggregate.ai/model?slug=llama3-deepspeed-v1-0 · How It Works · Data refreshed daily, snapshot 2026-09-19.