gpt-sw3-6.7B: benchmark results
Provider: AI Sweden. Access: Open.
Unified ELO 1231 ± 104, rank #2595 of 2656 rated models, from 15 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| EuroEval Swedish NLU - Multi Wiki QA SV | 63.13 | Reading comprehension Score (%) | 43.1 |
| EuroEval Danish NLU - Multi Wiki QA DA | 67.2 | Reading comprehension Score (%) | 42.8 |
| EuroEval Norwegian Knowledge - Idioms NO | 0.26 | MCC (x100) | 24 |
| EuroEval Danish Knowledge | 13.1 | Knowledge Average Score (%) | 23.6 |
| Open Portuguese LLM - BLUEX | 25.73 | Accuracy (%) | 21.8 |
| Open Portuguese LLM - ASSIN2 RTE | 61.93 | Macro F1 (%) | 21.6 |
| EuroEval Danish Knowledge - Danish Citizen Tests | 13.1 | MCC (x100) | 20.8 |
| EuroEval Norwegian Knowledge - NRK Quiz QA | 5.39 | MCC (x100) | 20.8 |
| EuroEval Norwegian Knowledge | 2.82 | Knowledge Average Score (%) | 20.3 |
| Open Portuguese LLM - FaQuAD NLI | 43.97 | Macro F1 (%) | 17.1 |
| Open Portuguese LLM - ENEM | 21.13 | Accuracy (%) | 16.6 |
| Open Portuguese LLM - OAB Exams | 22.96 | Accuracy (%) | 7.5 |
Interactive version: theaggregate.ai/model?slug=gpt-sw3-6-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.