stablelm-2-12B: benchmark results

Provider: Stability AI. Access: Open.

Unified ELO 1445 ± 59, rank #1549 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR44.79Score82.3
Open Portuguese LLM - OAB Exams47.29Accuracy (%)65.7
Open Portuguese LLM - FaQuAD NLI71.14Macro F1 (%)62.7
Open Portuguese LLM - BLUEX54.1Accuracy (%)58.6
Open Portuguese LLM - ENEM64.31Accuracy (%)58.2
Open Portuguese LLM - ASSIN2 RTE89.86Macro F1 (%)52.6
Open LLM Leaderboard - MMLU-Pro30.72Score39
Open LLM Leaderboard - BBH45.09Score34.1
Open LLM Leaderboard - GPQA27.85Score33.5
Open LLM Leaderboard - MATH Level 54.31Score24.6
Open LLM Leaderboard - IFEval15.69Score5.9

Interactive version: theaggregate.ai/model?slug=stablelm-2-12b · How It Works · Data refreshed daily, snapshot 2026-09-19.