TinyLlama-Cinder-Agent-v1: benchmark results

Provider: Singapore Univ. Access: Open.

Unified ELO 1252 ± 21, rank #2802 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K21.15Accuracy (%) (5-shot)41.8
Open LLM Leaderboard - IFEval26.7Score23.6
Open LLM Leaderboard - MATH Level 53.47Score20.7
Open LLM Leaderboard v1 - MMLU26.89Accuracy (%) (5-shot)14.1
Open LLM Leaderboard v1 - ARC Challenge34.9Normalized accuracy (%) (25-shot)12.8
Open LLM Leaderboard v1 - WinoGrande59.12Accuracy (%) (5-shot)12.3
Open LLM Leaderboard v1 - HellaSwag53.87Normalized accuracy (%) (10-shot)11.7
Open LLM Leaderboard v1 - TruthfulQA MC239.08MC2 (%) (0-shot)10
Open LLM Leaderboard - BBH31.16Score8.4
Open LLM Leaderboard - MuSR33.95Score8.3
Open LLM Leaderboard - MMLU-Pro11.61Score7.3
Open LLM Leaderboard - GPQA24.41Score2.8

Interactive version: theaggregate.ai/model?slug=tinyllama-cinder-agent-v1 · How It Works · Data refreshed daily, snapshot 2026-09-23.