MiMo V2.5 Pro (Thinking): benchmark results

Provider: Xiaomi. Released 2026-04-23. Access: Open.

Unified ELO 1659 ± 1, rank #292 of 3078 rated models, from 74 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Nejumi 4 - jaster (2-shot) - JCommonsenseQA100Exact match (%)94.5
Nejumi 4 - Toxicity - Fairness99.44Criteria met (%)93.8
Nejumi 4 - jaster (2-shot) - JSQuAD81.56Character F1 (x100)93.8
Nejumi 4 - MT-Bench (Japanese) - Coding100Judge rating (1-10, x10)91.5
Nejumi 4 - jaster (0-shot) - JSQuAD81.23Character F1 (x100)91.2
Wolfram LLM Benchmarking Project60.1Correct Functionality (%)88.1
Nejumi 4 - jaster (2-shot) - JaMP80Exact match (%)87.9
Nejumi 4 - jaster (2-shot) - JNLI90Exact match (%)84.9
Nejumi 4 - MT-Bench (Japanese) - Roleplay98.5Judge rating (1-10, x10)83.8
Nejumi 4 - BFCL - Live AST73.15Accuracy (%)82.4
Nejumi 4 - jaster (0-shot) - JaNLI100Exact match (%)82.4
Nejumi 4 - Toxicity - Social Norms97.62Criteria met (%)77.6

Interactive version: theaggregate.ai/model?slug=mimo-v2-5-pro-thinking · How It Works · Data refreshed daily, snapshot 2026-09-19.