internlm2.5-20B-chat: benchmark results

Shanghai AI Lab's open 20B InternLM2.5 chat model (July 2024), reasoning-focused with long-context and tool/web-search support. Provider: Shanghai AI Lab. Released 2024-07-30. Access: Open.

Unified ELO 1541 ± 1, rank #539 of 1553 rated models, from 18 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - BBH62.83Score99.9
Open LLM Leaderboard - MATH Level 540.79Score90.6
Open LLM Leaderboard - MuSR16.74Score86.6
Open LLM Leaderboard - IFEval70.1Score83
Open LLM Leaderboard - GPQA9.51Score76
Open LLM Leaderboard - MMLU-Pro33.31Score73.7
Chatbot Arena (Text - Math)1206Arena Score20.3
Chatbot Arena (Text - Chinese)1245Arena Score19.5
Chatbot Arena (Text - Hard Prompts)1225Arena Score18.9
Chatbot Arena (Text - English)1234Arena Score17.8
Chatbot Arena (Text - Coding)1249Arena Score17.3
Chatbot Arena (Text - Multi-Turn)1167Arena Score17.3

Interactive version: theaggregate.ai/model?slug=internlm2-5-20b-chat · How It Works · Data refreshed daily, snapshot 2026-09-08.