IceLemonTeaRP-32k-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1486 ± 19, rank #1399 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - HellaSwag86.53Normalized accuracy (%) (10-shot)81.6
Open LLM Leaderboard v1 - TruthfulQA MC261.76MC2 (%) (0-shot)78.2
Open LLM Leaderboard v1 - ARC Challenge67.66Normalized accuracy (%) (25-shot)77.7
Open LLM Leaderboard v1 - GSM8K62.4Accuracy (%) (5-shot)75.7
Open LLM Leaderboard v1 - MMLU64.51Accuracy (%) (5-shot)71.8
Open LLM Leaderboard v1 - WinoGrande79.72Accuracy (%) (5-shot)70.7
Open LLM Leaderboard - MuSR42.9Score69.5
Open LLM Leaderboard - IFEval52.12Score62.1
Open LLM Leaderboard - BBH49.97Score48.3
Open LLM Leaderboard - GPQA29.03Score45
Open LLM Leaderboard - MMLU-Pro30.68Score38.9
Open LLM Leaderboard - MATH Level 55.44Score30.3

Interactive version: theaggregate.ai/model?slug=icelemontearp-32k-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.