PULI-LlumiX-32K: benchmark results

Provider: Other. Access: Open.

Unified ELO 1328 ± 19, rank #2591 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard - MuSR39.64Score39
Open LLM Leaderboard v1 - HellaSwag75Normalized accuracy (%) (10-shot)25.6
Open LLM Leaderboard v1 - GSM8K6.07Accuracy (%) (5-shot)25.1
Open LLM Leaderboard v1 - ARC Challenge48.63Normalized accuracy (%) (25-shot)23.4
Open LLM Leaderboard v1 - WinoGrande68.03Accuracy (%) (5-shot)22.2
Open LLM Leaderboard v1 - MMLU41.65Accuracy (%) (5-shot)21.8
Open LLM Leaderboard - MMLU-Pro16.81Score17.9
Open LLM Leaderboard - BBH31.89Score11.3
Open LLM Leaderboard - MATH Level 51.28Score9.2
Open LLM Leaderboard - IFEval17Score7.9
Open LLM Leaderboard - GPQA25.34Score6.9
Open LLM Leaderboard v1 - TruthfulQA MC236.93MC2 (%) (0-shot)4.6

Interactive version: theaggregate.ai/model?slug=puli-llumix-32k · How It Works · Data refreshed daily, snapshot 2026-09-23.