Fimbulvetr-Kuro-Lotus-10.7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1504 ± 20, rank #1167 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - WinoGrande84.14Accuracy (%) (5-shot)92.1
Open LLM Leaderboard v1 - MMLU66.99Accuracy (%) (5-shot)88.6
Open LLM Leaderboard v1 - HellaSwag87.87Normalized accuracy (%) (10-shot)88.4
Open LLM Leaderboard v1 - ARC Challenge69.54Normalized accuracy (%) (25-shot)83.5
Open LLM Leaderboard v1 - GSM8K66.87Accuracy (%) (5-shot)82.7
Open LLM Leaderboard - MuSR44.45Score80.6
Open LLM Leaderboard v1 - TruthfulQA MC260.95MC2 (%) (0-shot)76.8
Open LLM Leaderboard - IFEval49.39Score57.9
Open LLM Leaderboard - GPQA30.12Score57.4
Open LLM Leaderboard - MMLU-Pro33.89Score48.5
Open LLM Leaderboard - BBH43.42Score30.4
Open LLM Leaderboard - MATH Level 55.36Score29.8

Interactive version: theaggregate.ai/model?slug=fimbulvetr-kuro-lotus-10-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.