internlm2.5-20B-chat: benchmark results
Shanghai AI Lab's open 20B InternLM2.5 chat model (July 2024), reasoning-focused with long-context and tool/web-search support. Provider: Shanghai AI Lab. Released 2024-07-30. Access: Open.
Unified ELO 1541 ± 1, rank #539 of 1553 rated models, from 18 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - BBH | 62.83 | Score | 99.9 |
| Open LLM Leaderboard - MATH Level 5 | 40.79 | Score | 90.6 |
| Open LLM Leaderboard - MuSR | 16.74 | Score | 86.6 |
| Open LLM Leaderboard - IFEval | 70.1 | Score | 83 |
| Open LLM Leaderboard - GPQA | 9.51 | Score | 76 |
| Open LLM Leaderboard - MMLU-Pro | 33.31 | Score | 73.7 |
| Chatbot Arena (Text - Math) | 1206 | Arena Score | 20.3 |
| Chatbot Arena (Text - Chinese) | 1245 | Arena Score | 19.5 |
| Chatbot Arena (Text - Hard Prompts) | 1225 | Arena Score | 18.9 |
| Chatbot Arena (Text - English) | 1234 | Arena Score | 17.8 |
| Chatbot Arena (Text - Coding) | 1249 | Arena Score | 17.3 |
| Chatbot Arena (Text - Multi-Turn) | 1167 | Arena Score | 17.3 |
Interactive version: theaggregate.ai/model?slug=internlm2-5-20b-chat · How It Works · Data refreshed daily, snapshot 2026-09-08.