Laguna M.1: benchmark results

Poolside's open 225B MoE (23B active) agentic coding model trained with code-execution RL, scoring 72.5% on SWE-bench Verified (April 2026). Provider: Poolside. Released 2026-04-28. Access: Open.

Unified ELO 1563 ± 1, rank #392 of 1392 rated models, from 37 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AI Chess Leaderboard (Continuation)743Elo66.7
AI Chess Leaderboard (Reasoning)769Elo62.5
Wolfram LLM Benchmarking Project46Correct Functionality (%)59.5
Vals AI Terminal-Bench 2.031.46Accuracy (%)36.4
Vals AI CorpFin v258.16Accuracy (%)35.3
Vals AI LiveCodeBench68.12Accuracy (%)34.5
SvelteBench80Average pass@1 (%)27.4
Chatbot Arena (Code)1347.49Elo24.4
WebDev Arena (Frontend)1342Arena Score24.4
WebDev Arena (Reference-Based Design)1346Arena Score23
WebDev Arena1347.31Arena Score22.2
Vals AI LegalBench75.14Accuracy (%)22

Interactive version: theaggregate.ai/model?slug=laguna-m-1 · How It Works · Data refreshed daily, snapshot 2026-09-05.