Seneca-TRBench — leaderboard

Seneca-TRBench evaluates LLM Turkish language proficiency with MCQ structural-linguistics questions and GPT-4o-judged short-answer tasks.

Metric: Combined Score (self-reported). Source: benchmarklist.com. Status: saturation imminent. 5 models tracked.

Top models

#ModelScore
1GPT-593.5
2GPT-5 Nano92.9
3GPT-5 Mini92.4
4Claude Opus 4.190.06
5Claude Sonnet 4.588.78

Interactive version: theaggregate.ai/benchmark?slug=seneca-trbench · How the rankings work · Data refreshed daily, snapshot 2026-07-22.