TomGrc_FusionNet_34Bx2_MoE_v0.1_DPO_f16: benchmark results

Provider: Other. Access: Open.

Unified ELO 1568 ± 16, rank #801 of 2928 rated models, from 14 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - GSM8K74.45Accuracy (%) (5-shot)99.1
Open LLM Leaderboard v1 - ARC Challenge74.06Normalized accuracy (%) (25-shot)98.9
Open Chinese LLM - WinoGrande72.06Accuracy (%)98.8
Open LLM Leaderboard v1 - MMLU76.65Accuracy (%) (5-shot)97.8
Open Chinese LLM - ARC Challenge66.3Accuracy (%)97.6
Open Chinese LLM - HellaSwag71.08Accuracy (%)95.4
Open Chinese LLM - C-Eval Semantic90.5Accuracy (%)95
Open LLM Leaderboard v1 - TruthfulQA MC272.24MC2 (%) (0-shot)93.3
Open Chinese LLM - TruthfulQA MC62.18Accuracy (%)90.5
Open LLM Leaderboard v1 - WinoGrande83.35Accuracy (%) (5-shot)88.4
Open Chinese LLM - CMMLU70.13Accuracy (%)85.5
Open Chinese LLM Leaderboard66.39Average Score (%)83.7

Interactive version: theaggregate.ai/model?slug=tomgrc-fusionnet-34bx2-moe-v0-1-dpo-f16 · How It Works · Data refreshed daily, snapshot 2026-09-23.