GPT-JT-6B-v1: benchmark results

Provider: EleutherAI. Access: Open.

Unified ELO 1320 ± 22, rank #2621 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - MMLU47.19Accuracy (%) (5-shot)26.1
Open LLM Leaderboard - MuSR37.37Score25.6
Open LLM Leaderboard v1 - WinoGrande65.27Accuracy (%) (5-shot)18.5
Open LLM Leaderboard v1 - HellaSwag67.15Normalized accuracy (%) (10-shot)18.3
Open LLM Leaderboard v1 - ARC Challenge40.87Normalized accuracy (%) (25-shot)17.2
Open LLM Leaderboard - MMLU-Pro16.26Score16.9
Open LLM Leaderboard - BBH33.03Score16
Open LLM Leaderboard v1 - GSM8K1.21Accuracy (%) (5-shot)16
Open LLM Leaderboard - GPQA26.09Score14.5
Open LLM Leaderboard - IFEval20.61Score12.9
Open LLM Leaderboard - MATH Level 51.06Score7.6
Open LLM Leaderboard v1 - TruthfulQA MC237.07MC2 (%) (0-shot)4.8

Interactive version: theaggregate.ai/model?slug=gpt-jt-6b-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.