Teuken-7B-instruct-commercial-v0.4: benchmark results

Provider: OpenGPT-X. Access: Open.

Unified ELO 1332 ± 23, rank #1401 of 1632 rated models, from 184 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
LA Leaderboard - RagQuAS80.5Semantic Answer Similarity (x100)86.8
LA Leaderboard - QNLI Basque55.46Accuracy (%)86
LA Leaderboard55.99Average Score (%)79.4
LA Leaderboard - ClinDiagnosES59.73Semantic Answer Similarity (x100)77.6
LA Leaderboard - ClinTreatES61.68Semantic Answer Similarity (x100)77.6
LA Leaderboard - XL-Sum Spanish2.46BLEU77.6
LA Leaderboard - OpenBookQA Spanish34Accuracy (%)77.2
LA Leaderboard - PAWS-X Spanish64.05Accuracy (%)77.2
LA Leaderboard - Summarization Galician5.58BLEU76.1
LA Leaderboard - PAWS Galician63.35Accuracy (%)72.1
LA Leaderboard - xStoryCloze Spanish68.23Accuracy (%)70.6
LA Leaderboard - XNLI Galician46.46Accuracy (%)68.4

Interactive version: theaggregate.ai/model?slug=teuken-7b-instruct-commercial-v0-4 · How It Works · Data refreshed daily, snapshot 2026-10-08.