Teuken-7B-Instruct-v0.4 — benchmark results

Provider: OpenGPT-X. Released 2024-11-26. Access: Open.

Unified ELO 1242 ± 33, rank #1635 of 1776 rated models, from 63 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LA Leaderboard - XNLI Galician48.97Accuracy (%)92.6
LA Leaderboard57.03Average Score (%)86.8
LA Leaderboard - COPA Spanish82.8Accuracy (%)75
European LLM Leaderboard - Zero-Shot Accuracy48.22Average Accuracy (%)68.3
LA Leaderboard - Spanish Law Exams32.77Accuracy (%)64.7
EuroEval Portuguese NLU - MultiWikiQA PT70.1Reading comprehension Score (%)56.9
LA Leaderboard - AQuAS65.91Accuracy (%)55.9
EuroEval Finnish NLU - Tydiqa FI62.04Reading comprehension Score (%)52.5
European LLM Leaderboard - Accuracy45.68Average Accuracy (%)49
EuroEval Spanish NLU - MLQA ES59.32Reading comprehension Score (%)48.7
EuroEval Italian NLU - SQuAD IT63.01Reading comprehension Score (%)43.8
LA Leaderboard - GalCoLA51.14Accuracy (%)41.9

Interactive version: theaggregate.ai/model?slug=teuken-7b-instruct-v0-4 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.