gpt-sw3-40B — benchmark results

Provider: AI Sweden. Released 2023-02-22. Access: Open.

Unified ELO 1120 ± 34, rank #1754 of 1776 rated models, from 35 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Swedish NLU - Multi Wiki QA SV71.21Reading comprehension Score (%)64.4
EuroEval Danish NLU - Multi Wiki QA DA73.22Reading comprehension Score (%)61
EuroEval Icelandic Common Sense Reasoning2.08Common Sense Reasoning Average Score (%)33
EuroEval Swedish NLU - ScaLA SV8.21Linguistic acceptability Score (%)29.8
EuroEval Swedish NLU41.57NLU Average Score (%)29.6
EuroEval Danish NLU27.13NLU Average Score (%)27.9
EuroEval Danish NLU - ScaLA DA3.72Linguistic acceptability Score (%)26.5
EuroEval Danish Knowledge13.57Knowledge Average Score (%)24.3
EuroEval Norwegian Knowledge3.38Knowledge Average Score (%)22.6
EuroEval Norwegian Common Sense Reasoning5Common Sense Reasoning Average Score (%)22.4
EuroEval Swedish26.31Average Score (%)21.7
EuroEval Danish18.45Average Score (%)21.4

Interactive version: theaggregate.ai/model?slug=gpt-sw3-40b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.