TinyLlama-1.1B-Chat-v0.6: benchmark results

Provider: Singapore Univ. Access: Open.

Unified ELO 1233 ± 19, rank #2835 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K2.12Accuracy (%) (5-shot)19.5
Open LLM Leaderboard v1 - WinoGrande59.35Accuracy (%) (5-shot)12.6
Open LLM Leaderboard v1 - HellaSwag55.79Normalized accuracy (%) (10-shot)12.4
Open LLM Leaderboard - MATH Level 51.59Score11.6
Open LLM Leaderboard v1 - MMLU25.98Accuracy (%) (5-shot)10.9
Open LLM Leaderboard - GPQA25.84Score10.5
Open LLM Leaderboard v1 - ARC Challenge31.66Normalized accuracy (%) (25-shot)10.5
Open LLM Leaderboard - MuSR34.22Score9.6
Open LLM Leaderboard - BBH30.67Score7.1
Open LLM Leaderboard - MMLU-Pro11.49Score6.7
Open LLM Leaderboard - IFEval15.74Score6
Open LLM Leaderboard v1 - TruthfulQA MC234.72MC2 (%) (0-shot)1.5

Interactive version: theaggregate.ai/model?slug=tinyllama-1-1b-chat-v0-6 · How It Works · Data refreshed daily, snapshot 2026-09-23.