c4ai-command-r7B-arabic-02-2025: benchmark results

Provider: Cohere. Released 2025-02-27. Access: Open.

Unified ELO 1559 ± 24, rank #800 of 2656 rated models, from 151 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment Task58.33Accuracy (%)98.8
Open Arabic LLM - Arabic Exams64.99Accuracy (%)98.8
Open Arabic LLM - Arabic MMLU Social Science (Middle School)63.49Accuracy (%)98.8
Open Arabic LLM - Alghafa Multiple Choice Facts Truefalse Balanced Task96Accuracy (%)97.2
Open Arabic LLM - Alghafa Multiple Choice Rating Sentiment NO Neutral Task81.74Accuracy (%)92
QIMMA - FannOrFlop58.55F1 (%)87.8
Open Arabic LLM - Arabic MMLU Computer Science (Middle School)92.59Accuracy (%)87
Open Arabic LLM - Arabic MMLU Arabic Language (Grammar)53.42Accuracy (%)84.6
QIMMA - MizanQA59.98Normalized multiple-choice probability score (%)82.9
Open Arabic LLM - Madinah QA Arabic Language (Grammar)55.62Accuracy (%)82.4
Open Arabic LLM - Madinah QA Average63.84Accuracy (%)81.5
QIMMA - ArabCulture66.94Accuracy (%, log-likelihood multiple choice)80.5

Interactive version: theaggregate.ai/model?slug=c4ai-command-r7b-arabic-02-2025 · How It Works · Data refreshed daily, snapshot 2026-09-19.