Command-R+: benchmark results

Cohere Command R+ model, a higher-capacity Command R variant for retrieval, tool use, and complex enterprise tasks. Provider: Cohere. Released 2024-04-04. Access: Open.

Unified ELO 1458 ± 1, rank #906 of 1392 rated models, from 79 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Safety SimpleSafetyTests100LM Evaluated Safety score (%)86
CRM LLM Leaderboard66.2CRM Accuracy (0-100)85.3
RABBITS B4BQA98.28Accuracy (%)73.2
Ru Arena Hard77.17Win Rate (%)71.9
IFEval Leaderboard77.01Final Score70
BenchBench61.83Aggregate Score (%)66.9
MixEval51.4Score64.7
HELM WMT 201420.33BLEU-4 (%)62.8
NoLiMa90.9Base Score (%)61.9
MAGI-Hard49.7Accuracy (%, 2024-05 snapshot)60.3
LingOly21.5Exact Match Accuracy60
EvalPlus (HumanEval+ & MBPP+)60.1Pass@1 avg (%)58.1

Interactive version: theaggregate.ai/model?slug=command-r-plus · How It Works · Data refreshed daily, snapshot 2026-09-05.