Exaone 4.0 1.2B (Reasoning) — benchmark results

Provider: LG AI. Released 2025-07-15. Access: Open.

Unified ELO 1360 ± 43, rank #1381 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench51.64Pass@1 (%)58.5
AA AIME 202550.33Accuracy (%)48.5
AA Humanity's Last Exam5.84Accuracy (%)42.9
CritPt0Accuracy (self-reported)30.3
AA GPQA Diamond51.52Accuracy (%)27.9
AA CritPt0Accuracy (%)27.1
AA MMLU-Pro58.77Accuracy (%)22.4
AA Omniscience - Software Engineering (SWE) - Go8Accuracy (%)17.5
AA TAU-2 Bench16.37Accuracy (%)14.6
AA Omniscience - Software Engineering (SWE) - Java8Accuracy (%)12.3
AA Omniscience - Software Engineering (SWE) - JavaScript15.45Accuracy (%)11.3
AA SciCode9.26Accuracy (%)9.6

Interactive version: theaggregate.ai/model?slug=exaone-4-0-1-2b-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.