K-EXAONE: benchmark results

LG AI Research's open Korean frontier 236B MoE (23B active) with 256K context, hybrid attention and multi-token prediction (December 2025). Provider: LG AI. Released 2025-12-31. Access: Open.

Unified ELO 1685 ± 16, rank #355 of 2656 rated models, from 45 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - ALT - Toxicity84.17Score (%)81.2
Nejumi 4 - ALT - Bias89.47Score (%)69.9
ALL Bench LLM72.78Average Numeric Benchmark Score (%)68.4
OpenEvals - MMLU-Pro83.8Accuracy (%)59.4
LLM Stats Score26.21LLM Stats Score (conservative rating)58.7
Nejumi 4 - ALT - Truthfulness74.12Score (%)53.9
Nejumi 4 - GLP - Specialized Knowledge59.94Score (%)46.1
Dnotitia Korean LLM Leaderboard83.1Mean Item Score (%)44
Nejumi 4 - GLP - Logical Reasoning86Score (%)43.4
LLM Stats (MMMLU)85.7Score (%)42.3
OpenEvals - GPQA Diamond79.1Accuracy (%)42.3
Nejumi 4 - ALT Average83.66Score (%)41.4

Interactive version: theaggregate.ai/model?slug=k-exaone · How It Works · Data refreshed daily, snapshot 2026-09-19.