K-EXAONE-236B-A23B: benchmark results

Provider: LG AI. Access: Open.

Unified ELO 1557 ± 1, rank #413 of 1392 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - ALT - Toxicity84.17Score (%)81.1
Nejumi 4 - ALT - Bias89.47Score (%)70.1
LLM Stats Score26.13LLM Stats Score (conservative rating)59.8
OpenEvals - MMLU-Pro83.8Accuracy (%)59.4
Nejumi 4 - ALT - Truthfulness74.12Score (%)52.5
Nejumi 4 - GLP - Specialized Knowledge59.94Score (%)47.5
Nejumi 4 - GLP - Logical Reasoning86Score (%)42.6
OpenEvals - GPQA Diamond79.1Accuracy (%)42.3
Nejumi 4 - ALT Average83.66Score (%)41
Nejumi 4 - GLP - Mathematical Reasoning93.17Score (%)40.6
LLM Stats (MMMLU)85.7Score (%)40
Nejumi 4 - ALT - Controllability85.18Score (%)39.3

Interactive version: theaggregate.ai/model?slug=k-exaone-236b-a23b · How It Works · Data refreshed daily, snapshot 2026-09-05.