aya-23-35B — benchmark results

Cohere Aya 23 35B multilingual instruction-tuned model. Provider: Cohere. Released 2024-05-23. Access: Open.

Unified ELO 1483 ± 11, rank #864 of 1776 rated models, from 328 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Japanese LLM - Xlsum JA Bert Score JA F172.12Score (%)97.1
Open Japanese LLM - SUM14.43Score (%)96.9
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task57.38Accuracy (%)96.3
Open Japanese LLM - Xlsum JA Rouge214.41Score (%)95.2
EuroEval English NLU - SQuAD87.4Reading comprehension Score (%)94.5
EuroEval French NLU - FQuAD74.54Reading comprehension Score (%)93.8
Open Arabic LLM - Aratrust Offensive94.2Accuracy (%)93.5
EuroEval Portuguese NLU - MultiWikiQA PT77.18Reading comprehension Score (%)93.3
Open Japanese LLM - Xlsum JA RougeLsum29.01Score (%)93
EuroEval Spanish NLU - MLQA ES67.9Reading comprehension Score (%)92.4
Open Japanese LLM - Xlsum JA Rouge134.08Score (%)91.8
LogicKor - Writing9.42Score (0-10)91.2

Interactive version: theaggregate.ai/model?slug=aya-23-35b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.