stablelm-2-1.6B — benchmark results
Provider: Stability AI. Released 2024-01-19. Access: Open.
Unified ELO 1272 ± 49, rank #1586 of 1776 rated models, from 30 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Portuguese NLU - SST-2 PT | 75.29 | Sentiment classification Score (%) | 46.4 |
| EuroEval Dutch NLU - DBRD | 85.84 | Sentiment classification Score (%) | 45.9 |
| EuroEval Portuguese NLU - MultiWikiQA PT | 65.49 | Reading comprehension Score (%) | 40.3 |
| EuroEval Portuguese NLU | 41.85 | NLU Average Score (%) | 32.1 |
| EuroEval Danish Knowledge | 19.62 | Knowledge Average Score (%) | 28.2 |
| Open LLM Leaderboard - MuSR | 5.79 | Score | 28.1 |
| EuroEval English Knowledge | 40.83 | Knowledge Average Score (%) | 26.2 |
| EuroEval Portuguese | 28.87 | Average Score (%) | 25.6 |
| EuroEval Norwegian Knowledge | 3.25 | Knowledge Average Score (%) | 22 |
| EuroEval Norwegian Common Sense Reasoning | 3.66 | Common Sense Reasoning Average Score (%) | 20.3 |
| Open Medical LLM - PubMedQA | 67.6 | Accuracy (%) | 20.2 |
| EuroEval Portuguese NLU - ScaLA PT | 1.04 | Linguistic acceptability Score (%) | 19.5 |
Interactive version: theaggregate.ai/model?slug=stablelm-2-1-6b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.