gpt-sw3-6.7B: benchmark results

Provider: AI Sweden. Access: Open.

Unified ELO 1231 ± 104, rank #2595 of 2656 rated models, from 15 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
EuroEval Swedish NLU - Multi Wiki QA SV63.13Reading comprehension Score (%)43.1
EuroEval Danish NLU - Multi Wiki QA DA67.2Reading comprehension Score (%)42.8
EuroEval Norwegian Knowledge - Idioms NO0.26MCC (x100)24
EuroEval Danish Knowledge13.1Knowledge Average Score (%)23.6
Open Portuguese LLM - BLUEX25.73Accuracy (%)21.8
Open Portuguese LLM - ASSIN2 RTE61.93Macro F1 (%)21.6
EuroEval Danish Knowledge - Danish Citizen Tests13.1MCC (x100)20.8
EuroEval Norwegian Knowledge - NRK Quiz QA5.39MCC (x100)20.8
EuroEval Norwegian Knowledge2.82Knowledge Average Score (%)20.3
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open Portuguese LLM - ENEM21.13Accuracy (%)16.6
Open Portuguese LLM - OAB Exams22.96Accuracy (%)7.5

Interactive version: theaggregate.ai/model?slug=gpt-sw3-6-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.