Everyone-Coder-4x7B-Base: benchmark results

Provider: Other. Access: Open.

Unified ELO 1428 ± 32, rank #1684 of 2656 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI70.39Macro F1 (%)61
Open Portuguese LLM - OAB Exams44.65Accuracy (%)58.8
Open Portuguese LLM - ENEM64.1Accuracy (%)57.7
Open Portuguese LLM - ASSIN2 RTE89.49Macro F1 (%)50.6
Open Portuguese LLM - BLUEX51.6Accuracy (%)50
Open Chinese LLM - GSM8K40.86Accuracy (%)40.2
Open Chinese LLM - CMMLU48.58Accuracy (%)29.7
Open Chinese LLM - HellaSwag55.64Accuracy (%)27.3
Open Chinese LLM - TruthfulQA MC51.33Accuracy (%)27.3
Open Chinese LLM Leaderboard51.32Average Score (%)22.8
Open Chinese LLM - ARC Challenge46.33Accuracy (%)21.8
Open Chinese LLM - C-Eval Semantic56.05Accuracy (%)17.5

Interactive version: theaggregate.ai/model?slug=everyone-coder-4x7b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.