Laguna XS 2.1: benchmark results
Provider: Poolside. Released 2026-07-02. Access: Open.
Unified ELO 1731 ± 23, rank #271 of 2656 rated models, from 14 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| BenchmarkList ECI | 124.55 | Capability Index (ECI) | 69.6 |
| ObviousBench | 92.36 | Answer pass³ (%) | 55.4 |
| LLM Stats Score | 24.38 | LLM Stats Score (conservative rating) | 55.2 |
| AI Chess Leaderboard (Reasoning) | 711 | Elo | 53.5 |
| AI Chess Leaderboard (Continuation) | 579 | Elo | 47.7 |
| SpeechMap Compliance | 53.7 | % Requests Completed | 38.5 |
| LLM Stats (SWE-bench Multilingual) | 63.1 | Score (%) | 29.5 |
| SvelteBench | 81.1 | Average pass@1 (%) | 29.5 |
| LM Market Cap LMC Score | 40 | LMC Score (0-100) | 28 |
| Tinybird AI SQL Benchmark - Exactness | 40.56 | Result exactness vs human reference queries (0-100) | 23 |
| Tinybird AI SQL Benchmark - Success Rate | 92 | Questions answered with a valid query within 3 retries (%) | 16.8 |
| Gert Labs Rankings | 24.88 | GScore (%) | 14.1 |
Interactive version: theaggregate.ai/model?slug=laguna-xs-2-1 · How It Works · Data refreshed daily, snapshot 2026-09-19.