RedPajama-INCITE-Base-3B-v1: benchmark results

Provider: Together. Released 2023-05-04. Access: Open.

Unified ELO 1233 ± 10, rank #2833 of 2928 rated models, from 102 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Physics37.09Accuracy (%)88
MMLU-by-task - College Mathematics36Accuracy (%)80.3
HELM Classic - Entity Data Imputation82.82Exact Match (%)78.8
HELM Classic - TruthfulQA27.68Exact Match (%)68.2
HELM Classic - LSAT21.3Exact Match (%)66.9
MMLU-by-task - Moral Scenarios26.59Accuracy (%)55.2
HELM Classic - CivilComments54.87Exact Match (%)54.5
MMLU-by-task - High School Statistics36.57Accuracy (%)45.6
MMLU-by-task - Abstract Algebra29Accuracy (%)45.3
HELM Classic - Dyck53Exact Match (%)44.1
HELM Classic - bAbI46.58Exact Match (%)39.1
MMLU-by-task - Elementary Mathematics26.98Accuracy (%)39

Interactive version: theaggregate.ai/model?slug=redpajama-incite-base-3b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.