InternLM2.5-1.8B-Chat: benchmark results

Provider: Shanghai AI Lab. Released 2024-08-01. Access: Open.

Unified ELO 1269 ± 51, rank #2542 of 2656 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MATH Level 515.86Score63.5
Open LLM Leaderboard - GPQA29.03Score45
Open LLM Leaderboard - IFEval38.49Score37.8
Open LLM Leaderboard - BBH44.89Score33.7
Open Portuguese LLM - BLUEX31.57Accuracy (%)27.6
Open Portuguese LLM - ASSIN2 RTE73.59Macro F1 (%)26.7
Open Portuguese LLM - OAB Exams30.02Accuracy (%)25.4
Open Portuguese LLM - ENEM29.46Accuracy (%)24.1
Open LLM Leaderboard - MuSR35.94Score17.8
Open Portuguese LLM - FaQuAD NLI43.97Macro F1 (%)17.1
Open LLM Leaderboard - MMLU-Pro12.99Score10.7
CVGEvalKit3.01ROUGE-10

Interactive version: theaggregate.ai/model?slug=internlm2-5-1-8b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.