UNA-ThePitbull-21.4B-v2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1514 ± 20, rank #1074 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - HellaSwag91.79Normalized accuracy (%) (10-shot)99.9
Open LLM Leaderboard v1 - ARC Challenge77.73Normalized accuracy (%) (25-shot)99.7
Open LLM Leaderboard v1 - WinoGrande87.37Accuracy (%) (5-shot)99.6
Open LLM Leaderboard v1 - TruthfulQA MC278.24MC2 (%) (0-shot)98.8
Open LLM Leaderboard v1 - MMLU68.25Accuracy (%) (5-shot)91
Open LLM Leaderboard - BBH63.5Score87.5
Open LLM Leaderboard v1 - GSM8K63.53Accuracy (%) (5-shot)77
Open LLM Leaderboard - GPQA30.2Score58.3
Open LLM Leaderboard - MATH Level 512.16Score54.6
Open LLM Leaderboard - MMLU-Pro35.16Score52
Open LLM Leaderboard - IFEval37.9Score37.1
Open LLM Leaderboard - MuSR39.22Score36.5

Interactive version: theaggregate.ai/model?slug=una-thepitbull-21-4b-v2 · How It Works · Data refreshed daily, snapshot 2026-09-23.