KangalKhan-RawRuby-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1475 ± 19, rank #1511 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - ARC Challenge66.89Normalized accuracy (%) (25-shot)75.1
Open LLM Leaderboard v1 - HellaSwag85.53Normalized accuracy (%) (10-shot)75.1
Open LLM Leaderboard v1 - GSM8K62.02Accuracy (%) (5-shot)75
Open LLM Leaderboard v1 - TruthfulQA MC257.09MC2 (%) (0-shot)69.4
Open LLM Leaderboard - IFEval54.77Score66.1
Open LLM Leaderboard v1 - WinoGrande78.69Accuracy (%) (5-shot)64.9
Open LLM Leaderboard v1 - MMLU63.46Accuracy (%) (5-shot)60.9
Open LLM Leaderboard - GPQA28.78Score42.5
Open LLM Leaderboard - BBH47.55Score40.4
Open LLM Leaderboard - MuSR39.5Score38.2
Open LLM Leaderboard - MMLU-Pro30.23Score37.1
Open LLM Leaderboard - MATH Level 56.65Score35.9

Interactive version: theaggregate.ai/model?slug=kangalkhan-rawruby-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.