Laguna XS.2: benchmark results
Poolside's open agentic-coding MoE (33B total, 3B active) for single-GPU local use. Provider: Poolside. Released 2026-04-28. Access: Open.
Unified ELO 1538 ± 1, rank #494 of 1392 rated models, from 31 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| SvelteBench | 92.2 | Average pass@1 (%) | 69.2 |
| Wolfram LLM Benchmarking Project | 39 | Correct Functionality (%) | 45.7 |
| Vals AI LiveCodeBench | 67.8 | Accuracy (%) | 33.8 |
| Vals AI CorpFin v2 | 56.33 | Accuracy (%) | 32.3 |
| Vals AI Terminal-Bench 2.0 | 28.09 | Accuracy (%) | 28.8 |
| PM-LLM-Benchmark | 25.6 | Score | 18.7 |
| Vals AI LegalBench | 71.03 | Accuracy (%) | 18.4 |
| Chatbot Arena (Code) | 1302.25 | Elo | 17.1 |
| WebDev Arena (Frontend) | 1299 | Arena Score | 17.1 |
| WebDev Arena (Reference-Based Design) | 1287 | Arena Score | 16.4 |
| Vals AI GPQA | 55.05 | Accuracy (%) | 15.3 |
| WebDev Arena | 1301.97 | Arena Score | 14.5 |
Interactive version: theaggregate.ai/model?slug=laguna-xs-2 · How It Works · Data refreshed daily, snapshot 2026-09-05.