InternLM2.5-1.8B-Chat: benchmark results
Provider: Shanghai AI Lab. Released 2024-08-01. Access: Open.
Unified ELO 1269 ± 51, rank #2542 of 2656 rated models, from 12 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open LLM Leaderboard - MATH Level 5 | 15.86 | Score | 63.5 |
| Open LLM Leaderboard - GPQA | 29.03 | Score | 45 |
| Open LLM Leaderboard - IFEval | 38.49 | Score | 37.8 |
| Open LLM Leaderboard - BBH | 44.89 | Score | 33.7 |
| Open Portuguese LLM - BLUEX | 31.57 | Accuracy (%) | 27.6 |
| Open Portuguese LLM - ASSIN2 RTE | 73.59 | Macro F1 (%) | 26.7 |
| Open Portuguese LLM - OAB Exams | 30.02 | Accuracy (%) | 25.4 |
| Open Portuguese LLM - ENEM | 29.46 | Accuracy (%) | 24.1 |
| Open LLM Leaderboard - MuSR | 35.94 | Score | 17.8 |
| Open Portuguese LLM - FaQuAD NLI | 43.97 | Macro F1 (%) | 17.1 |
| Open LLM Leaderboard - MMLU-Pro | 12.99 | Score | 10.7 |
| CVGEvalKit | 3.01 | ROUGE-1 | 0 |
Interactive version: theaggregate.ai/model?slug=internlm2-5-1-8b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.