M7-7B: benchmark results

Provider: Other. Access: Open.

Unified ELO 1491 ± 33, rank #1170 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Chinese LLM - TruthfulQA MC63.84Accuracy (%)95.4
Open Portuguese LLM - FaQuAD NLI77.86Macro F1 (%)81.7
Open Portuguese LLM - ASSIN2 RTE92.2Macro F1 (%)76
Open Chinese LLM - WinoGrande63.77Accuracy (%)60.8
Open Portuguese LLM - BLUEX54.52Accuracy (%)60.4
Open Chinese LLM - HellaSwag60.74Accuracy (%)57.9
Open Chinese LLM - ARC Challenge53.58Accuracy (%)57.6
Open Chinese LLM - GSM8K47.31Accuracy (%)57.1
Open Chinese LLM Leaderboard56.9Average Score (%)56.7
Open Portuguese LLM - ENEM63.75Accuracy (%)56.4
Open Portuguese LLM - OAB Exams41.59Accuracy (%)48.3
Open Chinese LLM - C-Eval Semantic62.44Accuracy (%)29.4

Interactive version: theaggregate.ai/model?slug=m7-7b · How It Works · Data refreshed daily, snapshot 2026-09-19.