internlm2.5-7B: benchmark results

Shanghai AI Lab's 7B InternLM2.5 base model with ~20% better reasoning than InternLM2 and support for up to 1M-token context (mid-2024). Provider: Shanghai AI Lab. Released 2024-06-28. Access: Open.

Unified ELO 1434 ± 1, rank #1019 of 1392 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GSMA Open-Telco - TeleTables30.13Score (%)58
Open PL LLM - Generative44.4Average Generative Score (%)43
Open PL LLM Leaderboard39.82Average Score (%)43
Open PL LLM - Multiple Choice33.87Average Multiple-Choice Score (%)41.3
Open PL LLM - RAG47.24Average RAG Score (%)35
GSMA Open-Telco - TeleLogs12.11Score (%)21.6
GSMA Open-Telco - TeleQnA66.9Score (%)21.6
GSMA Open-Telco - srsRAN-Bench73.81Score (%)19.3
GSMA Open-Telco - ORAN-Bench65.47Score (%)17
GSMA Open-Telco LLM Leaderboard40.38Average Score (%)13.6
GSMA Open-Telco - 3GPP25.42Score (%)9.1
GSMA Open-Telco - TeleMath8.8Score (%)9.1

Interactive version: theaggregate.ai/model?slug=internlm2-5-7b · How It Works · Data refreshed daily, snapshot 2026-09-05.