deepseek-moe-16B-base: benchmark results

Provider: DeepSeek. Released 2024-01-08. Access: Open.

Unified ELO 1304 ± 56, rank #2445 of 2656 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - OAB Exams31.75Accuracy (%)28.7
Open Portuguese LLM - ENEM36.25Accuracy (%)28.1
Open Portuguese LLM - ASSIN2 RTE76.22Macro F1 (%)27.9
Open Portuguese LLM - FaQuAD NLI44.71Macro F1 (%)26.6
Open Portuguese LLM - BLUEX30.32Accuracy (%)26.2
Open LLM Leaderboard - MuSR36.58Score21.1
Open LLM Leaderboard - IFEval24.5Score19
Open LLM Leaderboard - BBH34.09Score17.9
Open LLM Leaderboard - MATH Level 52.42Score15.9
Open LLM Leaderboard - MMLU-Pro15.05Score12.9
Open LLM Leaderboard - GPQA25.42Score7.5

Interactive version: theaggregate.ai/model?slug=deepseek-moe-16b-base · How It Works · Data refreshed daily, snapshot 2026-09-19.