internlm2.5-7B — benchmark results

Shanghai AI Lab's 7B InternLM2.5 base model with ~20% better reasoning than InternLM2 and support for up to 1M-token context (mid-2024). Provider: Shanghai AI Lab. Released 2024-06-28. Access: Open.

Unified ELO 1461 ± 30, rank #951 of 1776 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GSMA Open-Telco - TeleTables30.13Score (%)59.3
Open PL LLM - Generative44.4Average Generative Score (%)43
Open PL LLM Leaderboard39.82Average Score (%)43
Open PL LLM - Multiple Choice33.87Average Multiple-Choice Score (%)41.3
Open PL LLM - RAG47.24Average RAG Score (%)35
GSMA Open-Telco - TeleLogs12.11Score (%)22.1
GSMA Open-Telco - TeleQnA66.9Score (%)22.1
GSMA Open-Telco - srsRAN-Bench73.81Score (%)19.8
GSMA Open-Telco - ORAN-Bench65.47Score (%)17.4
GSMA Open-Telco LLM Leaderboard40.38Average Score (%)14
GSMA Open-Telco - 3GPP25.42Score (%)9.3
GSMA Open-Telco - TeleMath8.8Score (%)9.3

Interactive version: theaggregate.ai/model?slug=internlm2-5-7b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.