Command A — benchmark results

Cohere Command A model for enterprise chat, retrieval, tool use, and agentic workflows. Provider: Cohere. Released 2025-03-13. Access: Open.

Unified ELO 1578 ± 9, rank #535 of 1776 rated models, from 318 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
RefusalBench94.6Strict Refusal Rate (self-reported)100
Evals for Every Language - Language ars52.85Average Score (%)97.1
ProLLM - OpenBook Q&A86.3Score (%)92.4
Evals for Every Language - Language vai20Average Score (%)91.5
Evals for Every Language - Language zh67.23Average Score (%)91.3
ProLLM - Summarization91.2Score (%)89.7
Evals for Every Language - Language aeb48.44Average Score (%)87
Evals for Every Language - Language arz47.15Average Score (%)82.6
Evals for Every Language - Classification95.36Average Score (%)82.4
Evals for Every Language - Language hne45.8Average Score (%)80.9
Evals for Every Language - Language pt72.95Average Score (%)80.4
Evals for Every Language - Language kmb30.39Average Score (%)79.4

Interactive version: theaggregate.ai/model?slug=command-a · How the rankings work · Data refreshed daily, snapshot 2026-07-22.