Truthful_DPO_TomGrc_FusionNet_7Bx2_MoE_13B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1499 ± 33, rank #1111 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC62.97Accuracy (%)92.9
Open Chinese LLM - WinoGrande67.48Accuracy (%)83.4
Open Portuguese LLM - ASSIN2 RTE92.57Macro F1 (%)80.4
Open Portuguese LLM - FaQuAD NLI76.97Macro F1 (%)78.2
Open Chinese LLM - ARC Challenge54.27Accuracy (%)64.7
Open Chinese LLM - HellaSwag61.58Accuracy (%)64.1
Open Portuguese LLM - ENEM64.38Accuracy (%)58.4
Open Portuguese LLM - BLUEX53.41Accuracy (%)55.9
Open Chinese LLM Leaderboard56.71Average Score (%)52.4
Open Portuguese LLM - OAB Exams42.37Accuracy (%)51.5
Open Chinese LLM - GSM8K41.7Accuracy (%)41.2
Open Chinese LLM - C-Eval Semantic61.83Accuracy (%)25.2

Interactive version: theaggregate.ai/model?slug=truthful-dpo-tomgrc-fusionnet-7bx2-moe-13b · How It Works · Data refreshed daily, snapshot 2026-09-19.