stablelm-3B-4e1t — benchmark results
Provider: Stability AI. Released 2023-09-29. Access: Open.
Unified ELO 1251 ± 59, rank #1615 of 1776 rated models, from 15 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Portuguese NLU - MultiWikiQA PT | 68.83 | Reading comprehension Score (%) | 50.7 |
| EuroEval Portuguese NLU - SST-2 PT | 75.2 | Sentiment classification Score (%) | 46.1 |
| EuroEval Portuguese NLU | 44.45 | NLU Average Score (%) | 37.2 |
| EuroEval Portuguese | 30.82 | Average Score (%) | 28.3 |
| EuroEval Portuguese NLU - HAREM | 32.09 | Named entity recognition Score (%) | 25.3 |
| EuroEval Portuguese NLU - ScaLA PT | 1.7 | Linguistic acceptability Score (%) | 23.2 |
| Open LLM Leaderboard - MuSR | 4.42 | Score | 21.8 |
| Open LLM Leaderboard - BBH | 9.01 | Score | 18.8 |
| Open LLM Leaderboard - MMLU-Pro | 7.43 | Score | 17.7 |
| EuroEval Portuguese Knowledge | 6.14 | Knowledge Average Score (%) | 16.8 |
| EuroEval Portuguese Common Sense Reasoning | 0.94 | Common Sense Reasoning Average Score (%) | 15.6 |
| Open LLM Leaderboard - IFEval | 22.03 | Score | 15 |
Interactive version: theaggregate.ai/model?slug=stablelm-3b-4e1t · How the rankings work · Data refreshed daily, snapshot 2026-07-22.