gpt-sw3-20B: benchmark results

Provider: AI Sweden. Released 2022-12-14. Access: Open.

Unified ELO 1250 ± 69, rank #2575 of 2656 rated models, from 43 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Danish NLU - Multi Wiki QA DA72.47Reading comprehension Score (%)57.6
EuroEval Swedish NLU - Multi Wiki QA SV67.19Reading comprehension Score (%)48.2
EuroEval Norwegian Knowledge - Idioms NO2.73MCC (x100)45.6
EuroEval Swedish NLU - ScaLA SV12.95Linguistic acceptability Score (%)33.7
EuroEval Danish NLU - ScaLA DA8.38Linguistic acceptability Score (%)31.8
EuroEval Faroese NLU - FoSent8.4Sentiment classification Score (%)29.8
EuroEval Norwegian Knowledge4.61Knowledge Average Score (%)27.5
EuroEval Danish NLU26.95NLU Average Score (%)27
EuroEval Danish Knowledge - Danish Citizen Tests19.87MCC (x100)25.8
EuroEval Faroese NLU - ScaLA FO0.44Linguistic acceptability Score (%)24.4
EuroEval Icelandic Knowledge1.67Knowledge Average Score (%)24.2
Open Portuguese LLM - OAB Exams27.79Accuracy (%)22.8

Interactive version: theaggregate.ai/model?slug=gpt-sw3-20b · How It Works · Data refreshed daily, snapshot 2026-09-19.