stablelm-3B-4e1t — benchmark results

Provider: Stability AI. Released 2023-09-29. Access: Open.

Unified ELO 1251 ± 59, rank #1615 of 1776 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Portuguese NLU - MultiWikiQA PT68.83Reading comprehension Score (%)50.7
EuroEval Portuguese NLU - SST-2 PT75.2Sentiment classification Score (%)46.1
EuroEval Portuguese NLU44.45NLU Average Score (%)37.2
EuroEval Portuguese30.82Average Score (%)28.3
EuroEval Portuguese NLU - HAREM32.09Named entity recognition Score (%)25.3
EuroEval Portuguese NLU - ScaLA PT1.7Linguistic acceptability Score (%)23.2
Open LLM Leaderboard - MuSR4.42Score21.8
Open LLM Leaderboard - BBH9.01Score18.8
Open LLM Leaderboard - MMLU-Pro7.43Score17.7
EuroEval Portuguese Knowledge6.14Knowledge Average Score (%)16.8
EuroEval Portuguese Common Sense Reasoning0.94Common Sense Reasoning Average Score (%)15.6
Open LLM Leaderboard - IFEval22.03Score15

Interactive version: theaggregate.ai/model?slug=stablelm-3b-4e1t · How the rankings work · Data refreshed daily, snapshot 2026-07-22.