RedPajama-INCITE-Instruct-3B-v1: benchmark results

Provider: Together. Released 2023-05-05. Access: Open.

Unified ELO 1229 ± 10, rank #2844 of 2928 rated models, from 97 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Classic - Dyck70.8Exact Match (%)86.8
HELM Classic - bAbI52.21Exact Match (%)72.5
HELM Classic - RAFT66.14Exact Match (%)67.4
HELM Classic - NaturalQuestions Open Book63.71F1 (%)64.6
HELM Classic - Entity Matching82.79Exact Match (%)59.1
MMLU-by-task - Global Facts34Accuracy (%)58.3
HELM Classic - CivilComments54.95Exact Match (%)57.6
HELM Classic - Entity Data Imputation75.24Exact Match (%)51.5
HELM Classic - NarrativeQA63.76F1 (%)45.4
MMLU-by-task - College Chemistry28Accuracy (%)35
Open LLM Leaderboard - MuSR38.86Score34.5
MMLU-by-task - High School Mathematics25.93Accuracy (%)34

Interactive version: theaggregate.ai/model?slug=redpajama-incite-instruct-3b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.