deepseek-moe-16B-chat: benchmark results

Provider: DeepSeek. Released 2024-01-09. Access: Open.

Unified ELO 1328 ± 40, rank #2360 of 2656 rated models, from 12 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - FaQuAD NLI61.72Macro F1 (%)46.1
Open LLM Leaderboard - IFEval36.63Score35.2
Open Portuguese LLM - ENEM48.22Accuracy (%)32.9
Open Portuguese LLM - OAB Exams35.26Accuracy (%)32.4
Open Portuguese LLM - BLUEX37.97Accuracy (%)31.3
Open LLM Leaderboard - MuSR38.08Score30
Open Portuguese LLM - ASSIN2 RTE77.68Macro F1 (%)29.2
Open LLM Leaderboard - MMLU-Pro19.64Score21.3
Open LLM Leaderboard - MATH Level 52.57Score16.7
Open LLM Leaderboard - BBH32.75Score15
YALL Nous Leaderboard44.72Average9.5
Open LLM Leaderboard - GPQA22.48Score0.1

Interactive version: theaggregate.ai/model?slug=deepseek-moe-16b-chat · How It Works · Data refreshed daily, snapshot 2026-09-19.