Luth-0.6B-Instruct: benchmark results

Provider: Other. Released 2025-08-06. Access: Open.

Unified ELO 1353 ± 29, rank #2212 of 2656 rated models, from 49 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Kurakurai French LLM - BFCL v261.72Accuracy (%)69
Kurakurai French LLM - AIME 20251.33Accuracy (%)61
Kurakurai French LLM - MATH-50044.74Accuracy (%)61
Kurakurai French LLM - AIME 20242Accuracy (%)59.8
Kurakurai French LLM - MGSM58.52Accuracy (%)58.5
Kurakurai French LLM - HumanEval+30.25pass@1 (%)53.7
Kurakurai French LLM - MMLU-Pro25.4Accuracy (%)53.7
Open Portuguese LLM - FaQuAD NLI67.31Macro F1 (%)53.6
Kurakurai French LLM - MBPP34.74pass@1 (%)46.3
Kurakurai French LLM - MultiIF33.77Accuracy (%)46.3
Kurakurai French LLM - GPQA Diamond25.6Accuracy (%)43.9
Kurakurai French LLM - IFEval51.23Accuracy (%)41.5

Interactive version: theaggregate.ai/model?slug=luth-0-6b-instruct · How It Works · Data refreshed daily, snapshot 2026-09-19.