ReMask-3B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1339 ± 20, rank #2540 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K27.14Accuracy (%) (5-shot)45.1
Open LLM Leaderboard v1 - HellaSwag75.7Normalized accuracy (%) (10-shot)27.2
Open LLM Leaderboard v1 - MMLU41.82Accuracy (%) (5-shot)21.9
Open LLM Leaderboard - GPQA26.68Score21.2
Open LLM Leaderboard v1 - WinoGrande66.38Accuracy (%) (5-shot)20.2
Open LLM Leaderboard - BBH35.17Score19.6
Open LLM Leaderboard v1 - ARC Challenge43.77Normalized accuracy (%) (25-shot)19.5
Open LLM Leaderboard v1 - TruthfulQA MC242.13MC2 (%) (0-shot)19.4
Open LLM Leaderboard - IFEval24.19Score18.5
Open LLM Leaderboard - MATH Level 51.96Score13.8
Open LLM Leaderboard - MMLU-Pro13.57Score11.4
Open LLM Leaderboard - MuSR33.41Score6

Interactive version: theaggregate.ai/model?slug=remask-3b · How It Works · Data refreshed daily, snapshot 2026-09-23.