stablelm-2-1.6B-chat: benchmark results

Provider: Stability AI. Access: Open.

Unified ELO 1298 ± 56, rank #2465 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ENEM40.31Accuracy (%)29.9
Open Portuguese LLM - OAB Exams32.85Accuracy (%)29.2
Open Portuguese LLM - BLUEX33.24Accuracy (%)28.9
Open LLM Leaderboard - IFEval30.6Score28.1
Open Portuguese LLM - FaQuAD NLI44.66Macro F1 (%)25.9
Open Portuguese LLM - ASSIN2 RTE69.58Macro F1 (%)24.8
Open LLM Leaderboard - BBH33.9Score17.6
Open LLM Leaderboard - MuSR35.8Score17.1
Open LLM Leaderboard - MMLU-Pro16.22Score16.8
Open LLM Leaderboard - MATH Level 52.49Score16.3
Open LLM Leaderboard - GPQA24.75Score3.8

Interactive version: theaggregate.ai/model?slug=stablelm-2-1-6b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.