WestlakeMaziyar-7B-slerp: benchmark results

Provider: Other. Access: Open.

Unified ELO 1507 ± 21, rank #1143 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - WinoGrande86.9Accuracy (%) (5-shot)99.4
Open LLM Leaderboard v1 - ARC Challenge73.38Normalized accuracy (%) (25-shot)97
Open LLM Leaderboard v1 - HellaSwag88.71Normalized accuracy (%) (10-shot)93.7
Open LLM Leaderboard v1 - TruthfulQA MC268.75MC2 (%) (0-shot)88
Open LLM Leaderboard v1 - GSM8K68.46Accuracy (%) (5-shot)86
Open LLM Leaderboard - MuSR44.74Score82
Open LLM Leaderboard v1 - MMLU65.02Accuracy (%) (5-shot)80.5
Open LLM Leaderboard - BBH52.45Score61.5
Open LLM Leaderboard - GPQA30.37Score60.3
Open LLM Leaderboard - IFEval48.38Score56.5
Open LLM Leaderboard - MMLU-Pro30.78Score39.2
Open LLM Leaderboard - MATH Level 56.65Score35.9

Interactive version: theaggregate.ai/model?slug=westlakemaziyar-7b-slerp · How It Works · Data refreshed daily, snapshot 2026-09-23.