Kimi K2 Turbo (Thinking): benchmark results

Kimi K2 Turbo evaluated with thinking enabled. Provider: Moonshot. Released 2025-11-06. Access: Open.

Unified ELO 1631 ± 1, rank #314 of 1761 rated models, from 26 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chatbot Arena (Text - Math)1437Arena Score78.4
Chatbot Arena (Text - Coding)1486Arena Score78
Chatbot Arena (Text - English)1443Arena Score76.4
Chatbot Arena (Text - Chinese)1474Arena Score76.1
Chatbot Arena (Text - Hard Prompts)1453Arena Score76.1
Chatbot Arena (Text - Instruction Following)1418Arena Score75.2
Chatbot Arena (Text)1430Elo75.2
Chatbot Arena (Text - Multi-Turn)1433Arena Score74.9
Opper TaskBench90.8Avg Task Score (%)72.9
Chatbot Arena (Text - Creative Writing)1392Arena Score72.4
Chatbot Arena (Text - Longer Query)1433Arena Score71.2
Chatbot Arena (Text - Russian)1412Arena Score69.7

Interactive version: theaggregate.ai/model?slug=kimi-k2-turbo-thinking · How It Works · Data refreshed daily, snapshot 2026-09-05.