gpt-sw3-1.3B-instruct: benchmark results
Provider: AI Sweden. Released 2023-04-28. Access: Open.
Unified ELO 1223 ± 20, rank #2860 of 2928 rated models, from 20 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Swedish NLU - Swerec | 73.34 | Sentiment classification Score (%) | 42.5 |
| EuroEval Norwegian NLU - Norec | 35.58 | Sentiment classification Score (%) | 36.8 |
| EuroEval Danish NLU - Angry Tweets | 27.14 | Sentiment classification Score (%) | 24.6 |
| Open LLM Leaderboard v1 - GSM8K | 1.59 | Accuracy (%) (5-shot) | 17.7 |
| EuroEval Danish | 15.44 | Average Score (%) | 16.8 |
| EuroEval Norwegian | 8.88 | Average Score (%) | 16.6 |
| EuroEval Norwegian Knowledge - NRK Quiz QA | 3.36 | MCC (x100) | 16.2 |
| EuroEval Danish NLU - Multi Wiki QA DA | 17.3 | Reading comprehension Score (%) | 15.2 |
| EuroEval Swedish NLU - Multi Wiki QA SV | 15.01 | Reading comprehension Score (%) | 14.2 |
| Open LLM Leaderboard v1 - TruthfulQA MC2 | 40.31 | MC2 (%) (0-shot) | 13.6 |
| EuroEval Norwegian Knowledge | 1.29 | Knowledge Average Score (%) | 13.3 |
| Open LLM Leaderboard v1 - MMLU | 26.17 | Accuracy (%) (5-shot) | 11.6 |
Interactive version: theaggregate.ai/model?slug=gpt-sw3-1-3b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-23.