EuroEval Faroese NLU - ScaLA FO — leaderboard

Metric: Linguistic acceptability Score (%). Source: euroeval.com. 406 models tracked.

Top models

#ModelScore
1Gemini 3 Pro (Preview)54.6
2Gemini 2.5 Flash (Preview 04-17)51.83
3GPT-5 (High)50.38
4Claude 3.7 Sonnet (20250219) (Thinking)49.81
5GPT-5.4 Mini (Medium)46.34
6Gemini 3.1 Flash Lite (Preview)45.52
7Gemini 2.5 Pro45.33
8GPT-5.4 Mini (High)44.49
9GPT-542.6
10Claude Sonnet 4.5 (Thinking)38.51
11Gemini 2.5 Flash (Thinking)36.77
12Qwen 3 235B A22B 2507 Instruct35.75
13Grok 4.1 Fast (Reasoning)35.21
14Gemma 4 31B (IT)34.48
15Grok 3 Mini34.07

Interactive version: theaggregate.ai/benchmark?slug=euroeval-faroese-nlu-scala-fo · How the rankings work · Data refreshed daily, snapshot 2026-07-22.