aya-23-35B: benchmark results

Cohere Aya 23 35B multilingual instruction-tuned model. Provider: Cohere. Released 2024-05-23. Access: Open.

Unified ELO 1469 ± 1, rank #843 of 1392 rated models, from 333 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA Bert Score JA F172.12Score (%)97.1
Open Japanese LLM - SUM14.43Score (%)96.9
Open Japanese LLM - Xlsum JA Rouge214.41Score (%)96.9
Open Japanese LLM - Xlsum JA Bleu JA4.15Score (%)96.6
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task57.38Accuracy (%)96.3
EuroEval English NLU - SQuAD87.4Reading comprehension Score (%)94.5
EuroEval French NLU - FQuAD74.54Reading comprehension Score (%)93.8
Open Arabic LLM - Aratrust Offensive94.2Accuracy (%)93.5
Open Japanese LLM - Xlsum JA RougeLsum29.01Score (%)93.5
EuroEval Portuguese NLU - MultiWikiQA PT77.18Reading comprehension Score (%)93.3
EuroEval Spanish NLU - MLQA ES67.9Reading comprehension Score (%)92.4
Open Japanese LLM - Xlsum JA Rouge134.08Score (%)92.1

Interactive version: theaggregate.ai/model?slug=aya-23-35b · How It Works · Data refreshed daily, snapshot 2026-09-05.