EXAONE-3.5-2.4B-Instruct — benchmark results
LG AI Research's smallest EXAONE 3.5 instruct model (2.4B), Korean/English bilingual with a 32K context (December 2024). Provider: LG AI. Released 2024-12-01. Access: Open.
Unified ELO 1520 ± 139, rank #726 of 1776 rated models, from 10 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - IFEval | 79.5 | Score | 96.8 |
| Open LLM Leaderboard - MATH Level 5 | 36.78 | Score | 87.2 |
| SLM-RAG Arena | 1567.2 | Elo Rating | 81.2 |
| Mobile-MMLU | 53.7 | Overall Accuracy (%) | 47.6 |
| Open LLM Leaderboard - MMLU-Pro | 25.34 | Score | 45.4 |
| Open LLM Leaderboard - BBH | 15.95 | Score | 24.3 |
| Open LLM Leaderboard - GPQA | 2.13 | Score | 20.3 |
| Open LLM Leaderboard - MuSR | 3.17 | Score | 14.9 |
| Wolfram LLM Benchmarking Project | 16 | Correct Functionality (%) | 12.5 |
| CPTU Bench | 1.67 | Average Score (1-5) | 3.3 |
Interactive version: theaggregate.ai/model?slug=exaone-3-5-2-4b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.