TinyYi-7B-Test: benchmark results

Provider: Other. Access: Open.

Unified ELO 1197 ± 20, rank #2905 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC246.35MC2 (%) (0-shot)34.1
Open LLM Leaderboard - GPQA26.43Score18.3
Open LLM Leaderboard - IFEval18.56Score9.9
Open LLM Leaderboard - MuSR33.64Score7
Open LLM Leaderboard v1 - ARC Challenge26.88Normalized accuracy (%) (25-shot)6.1
Open LLM Leaderboard v1 - GSM8K0Accuracy (%) (5-shot)4.6
Open LLM Leaderboard v1 - WinoGrande50.91Accuracy (%) (5-shot)4.6
Open LLM Leaderboard v1 - MMLU24.41Accuracy (%) (5-shot)3.7
Open LLM Leaderboard v1 - HellaSwag26.14Normalized accuracy (%) (10-shot)2.5
Open LLM Leaderboard - BBH29.1Score2
Open LLM Leaderboard - MATH Level 50Score1.3
Open LLM Leaderboard - MMLU-Pro10.91Score0.8

Interactive version: theaggregate.ai/model?slug=tinyyi-7b-test · How It Works · Data refreshed daily, snapshot 2026-09-23.