gpt-sw3-1.3B-instruct: benchmark results

Provider: AI Sweden. Released 2023-04-28. Access: Open.

Unified ELO 1223 ± 20, rank #2860 of 2928 rated models, from 20 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Swedish NLU - Swerec73.34Sentiment classification Score (%)42.5
EuroEval Norwegian NLU - Norec35.58Sentiment classification Score (%)36.8
EuroEval Danish NLU - Angry Tweets27.14Sentiment classification Score (%)24.6
Open LLM Leaderboard v1 - GSM8K1.59Accuracy (%) (5-shot)17.7
EuroEval Danish15.44Average Score (%)16.8
EuroEval Norwegian8.88Average Score (%)16.6
EuroEval Norwegian Knowledge - NRK Quiz QA3.36MCC (x100)16.2
EuroEval Danish NLU - Multi Wiki QA DA17.3Reading comprehension Score (%)15.2
EuroEval Swedish NLU - Multi Wiki QA SV15.01Reading comprehension Score (%)14.2
Open LLM Leaderboard v1 - TruthfulQA MC240.31MC2 (%) (0-shot)13.6
EuroEval Norwegian Knowledge1.29Knowledge Average Score (%)13.3
Open LLM Leaderboard v1 - MMLU26.17Accuracy (%) (5-shot)11.6

Interactive version: theaggregate.ai/model?slug=gpt-sw3-1-3b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-23.