FuseChat-7B-VaRM: benchmark results

Provider: FuseAI. Access: Open.

Unified ELO 1475 ± 19, rank #1513 of 2928 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI78.73Macro F1 (%)85.4
Open Portuguese LLM - ASSIN2 RTE92.73Macro F1 (%)82.8
Open LLM Leaderboard v1 - GSM8K63.46Accuracy (%) (5-shot)76.9
Open LLM Leaderboard v1 - WinoGrande79.16Accuracy (%) (5-shot)67.7
Open LLM Leaderboard v1 - HellaSwag84.25Normalized accuracy (%) (10-shot)64.9
Open LLM Leaderboard v1 - MMLU63.71Accuracy (%) (5-shot)62.7
Open Portuguese LLM - BLUEX54.94Accuracy (%)61.9
Open LLM Leaderboard v1 - ARC Challenge62.88Normalized accuracy (%) (25-shot)60.2
Open Portuguese LLM - ENEM64.8Accuracy (%)59.9
Open Portuguese LLM - OAB Exams41.82Accuracy (%)49.6
YALL Nous Leaderboard52.3Average47.5
Open LLM Leaderboard v1 - TruthfulQA MC245.67MC2 (%) (0-shot)31.8

Interactive version: theaggregate.ai/model?slug=fusechat-7b-varm · How It Works · Data refreshed daily, snapshot 2026-09-23.