stablelm-2-1.6B — benchmark results

Provider: Stability AI. Released 2024-01-19. Access: Open.

Unified ELO 1272 ± 49, rank #1586 of 1776 rated models, from 30 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Portuguese NLU - SST-2 PT75.29Sentiment classification Score (%)46.4
EuroEval Dutch NLU - DBRD85.84Sentiment classification Score (%)45.9
EuroEval Portuguese NLU - MultiWikiQA PT65.49Reading comprehension Score (%)40.3
EuroEval Portuguese NLU41.85NLU Average Score (%)32.1
EuroEval Danish Knowledge19.62Knowledge Average Score (%)28.2
Open LLM Leaderboard - MuSR5.79Score28.1
EuroEval English Knowledge40.83Knowledge Average Score (%)26.2
EuroEval Portuguese28.87Average Score (%)25.6
EuroEval Norwegian Knowledge3.25Knowledge Average Score (%)22
EuroEval Norwegian Common Sense Reasoning3.66Common Sense Reasoning Average Score (%)20.3
Open Medical LLM - PubMedQA67.6Accuracy (%)20.2
EuroEval Portuguese NLU - ScaLA PT1.04Linguistic acceptability Score (%)19.5

Interactive version: theaggregate.ai/model?slug=stablelm-2-1-6b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.