MiMo-V2-Omni — benchmark results

Xiaomi's omni-modal MiMo-V2 model unifying text, vision, and speech in one backbone. Provider: Xiaomi. Released 2026-03-18. Access: Open.

Unified ELO 1673 ± 23, rank #316 of 1776 rated models, from 54 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA-LCR66.7Score (self-reported)89.2
Video-MME-v247.1Avg Accuracy w/o sub (%)87.8
AA Long Context Reasoning66.67Accuracy (%)86.2
AA TAU-2 Bench91.23Accuracy (%)86.1
Artificial Analysis Intelligence Index34.99Intelligence Index83.8
BenchLM63.1Overall Score81.2
AA Terminal-Bench Hard34.85Accuracy (%)80.3
AA Humanity's Last Exam19.93Accuracy (%)80.1
AA GPQA Diamond82.83Accuracy (%)78.2
Chatbot Arena (Text)1430Elo77.8
CritPt1.1Accuracy (self-reported)77.4
AI Chess Leaderboard (Reasoning)876Elo76.9

Interactive version: theaggregate.ai/model?slug=mimo-v2-omni · How the rankings work · Data refreshed daily, snapshot 2026-07-22.