TinyLlama-1.1B-Chat-v0.1: benchmark results

Provider: Singapore Univ. Access: Open.

Unified ELO 1217 ± 19, rank #2874 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR35.92Score17.5
Open LLM Leaderboard v1 - MMLU26.71Accuracy (%) (5-shot)13.5
Open LLM Leaderboard v1 - GSM8K0.53Accuracy (%) (5-shot)12.8
Open LLM Leaderboard v1 - HellaSwag54.21Normalized accuracy (%) (10-shot)11.8
Open LLM Leaderboard v1 - ARC Challenge32Normalized accuracy (%) (25-shot)10.8
Open LLM Leaderboard v1 - TruthfulQA MC239.03MC2 (%) (0-shot)9.9
Open LLM Leaderboard v1 - WinoGrande54.93Accuracy (%) (5-shot)8.8
Open LLM Leaderboard - BBH30.84Score7.5
Open LLM Leaderboard - MATH Level 50.6Score5
Open LLM Leaderboard - IFEval14.79Score4.7
Open LLM Leaderboard - MMLU-Pro10.98Score1.3
Open LLM Leaderboard - GPQA22.9Score0.2

Interactive version: theaggregate.ai/model?slug=tinyllama-1-1b-chat-v0-1 · How It Works · Data refreshed daily, snapshot 2026-09-23.