EuroEval Latvian Common Sense Reasoning — leaderboard

Metric: Common Sense Reasoning Average Score (%). Source: euroeval.com. 212 models tracked.

Top models

#ModelScore
1GPT-5 Mini97.25
2Claude Sonnet 4.694.71
3Gemini 3 Pro (Preview)94.71
4Gemini 2.5 Pro94.34
5Gemini 3.1 Flash Lite (Preview)92.24
6GPT-5.4 Mini (Medium)92.24
7Gemma 3 27B (IT)92.21
8Gemini 3 Flash (Preview) (Non-reasoning)91.68
9GPT-5.4 Mini (High)91.59
10GPT-591.51
11GPT-5.291.23
12gemma-3-27B-pt91.19
13Claude Sonnet 4.5 (Thinking)90.43
14Qwen 3 235B A22B 2507 Instruct89.67
15Gemma 4 31B (IT)89.04

Interactive version: theaggregate.ai/benchmark?slug=euroeval-latvian-common-sense-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.