DiscoLM-70B: benchmark results

Provider: Other. Released 2023-11-19. Access: Open.

Unified ELO 1488 ± 20, rank #1369 of 2928 rated models, from 108 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU68.58Accuracy (%) (5-shot)91.6
Open LLM Leaderboard v1 - WinoGrande83.58Accuracy (%) (5-shot)89.7
Open LLM Leaderboard v1 - ARC Challenge68.77Normalized accuracy (%) (25-shot)81.4
Open LLM Leaderboard v1 - HellaSwag86.1Normalized accuracy (%) (10-shot)78.7
Open LLM Leaderboard v1 - GSM8K63.53Accuracy (%) (5-shot)77
EuroEval Portuguese NLU - HAREM49.95Named entity recognition Score (%)76.8
EuroEval Italian NLU - MultiNERD IT72.48Named entity recognition Score (%)75.1
EuroEval Faroese NLU - FONE71.63Named entity recognition Score (%)72.8
Open LLM Leaderboard v1 - TruthfulQA MC257.64MC2 (%) (0-shot)70.6
EuroEval German NLU - GermEval63.26Named entity recognition Score (%)69.6
EuroEval Danish NLU - Dansk57.93Named entity recognition Score (%)68.4
EuroEval Spanish NLU - CoNLL ES65.78Named entity recognition Score (%)64.9

Interactive version: theaggregate.ai/model?slug=discolm-70b · How It Works · Data refreshed daily, snapshot 2026-09-23.