Laguna XS.2 — benchmark results

Poolside's open agentic-coding MoE (33B total, 3B active) for single-GPU local use. Provider: Poolside. Released 2026-04-28. Access: Open.

Unified ELO 1544 ± 36, rank #641 of 1776 rated models, from 22 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
SvelteBench92.2Average pass@1 (%)71.6
Wolfram LLM Benchmarking Project39Correct Functionality (%)47.4
Vals AI LiveCodeBench66.61Accuracy (%)36.2
Vals AI CorpFin v256.33Accuracy (%)34.4
Vals AI Terminal-Bench 2.028.09Accuracy (%)28.8
Vals AI LegalBench71.03Accuracy (%)20.8
Chatbot Arena (Code)1303Elo20.2
PM-LLM-Benchmark25.6Score18.9
Vals AI GPQA58.08Accuracy (%)18
Vals AI Vibe Code Bench5.21Accuracy (%)14.3
Vals AI ProgramBench16.5Raw Pass Rate (%)13.3
Vals AI MMLU-Pro69.41Accuracy (%)10.7

Interactive version: theaggregate.ai/model?slug=laguna-xs-2 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.