Marin 8B Instruct — benchmark results

Provider: Other. Released 2025-05-14. Access: Open.

Unified ELO 1349 ± 24, rank #1420 of 1776 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Safety HarmBench75.1LM Evaluated Safety score (%)53.5
HELM Safety87Mean score (self-reported)27.3
HELM Safety Anthropic Red Team97LM Evaluated Safety score (%)23.3
HELM Safety SimpleSafetyTests95.8LM Evaluated Safety score (%)19.2
HELM Safety XSTest91.7LM Evaluated Safety score (%)15.1
HELM Capabilities - Omni-MATH15.95Acc14
HELM Safety BBQ75.5BBQ accuracy (%)14
HELM Capabilities - IFEval63.15IFEval Strict Acc6
HELM Capabilities - MMLU-Pro18.8COT correct2
HELM Capabilities - GPQA16.82COT correct0
HELM Capabilities - WildBench47.71WB Score0

Interactive version: theaggregate.ai/model?slug=marin-8b-instruct · How the rankings work · Data refreshed daily, snapshot 2026-07-22.