Kunoichi-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1493 ± 20, rank #1326 of 2928 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - HellaSwag87.1Normalized accuracy (%) (10-shot)84.5
Open LLM Leaderboard v1 - GSM8K67.02Accuracy (%) (5-shot)82.9
Open LLM Leaderboard v1 - TruthfulQA MC264.04MC2 (%) (0-shot)81.6
Open LLM Leaderboard v1 - ARC Challenge68.69Normalized accuracy (%) (25-shot)81.1
Open LLM Leaderboard v1 - MMLU64.9Accuracy (%) (5-shot)78.2
Open LLM Leaderboard v1 - WinoGrande81.06Accuracy (%) (5-shot)77
UGI - Willingness (W/10)4W/10 Score30.6
UGI Leaderboard25.77UGI Score20.7
UGI - Writing22.64Writing Score17.8
UGI - Natural Intelligence12.34NatInt Score10.2

Interactive version: theaggregate.ai/model?slug=kunoichi-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.