EXAONE 3.5 32B Instruct — benchmark results
LG AI Research's largest EXAONE 3.5 model: a 32B bilingual Korean-English instruct model with a 32K context (December 2024). Provider: LG AI. Released 2024-12-09. Access: Open.
Unified ELO 1516 ± 81, rank #747 of 1776 rated models, from 7 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 83.92 | Score | 99.5 |
| Open LLM Leaderboard - MATH Level 5 | 51.28 | Score | 97.5 |
| Open LLM Leaderboard - MMLU-Pro | 40.41 | Score | 85.3 |
| Open LLM Leaderboard - BBH | 39.82 | Score | 79 |
| Open LLM Leaderboard - GPQA | 5.03 | Score | 42.5 |
| Wolfram LLM Benchmarking Project | 28.3 | Correct Functionality (%) | 32.3 |
| Open LLM Leaderboard - MuSR | 5.15 | Score | 25.3 |
Interactive version: theaggregate.ai/model?slug=exaone-3-5-32b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.