DeepSeek V4 Flash (0731) (Non-reasoning): benchmark results

Provider: DeepSeek. Released 2026-07-31. Access: Open.

Unified ELO 1539 ± 1, rank #677 of 1761 rated models, from 7 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Chess Bench LLM-189Lichess Rating15.1
Korean LLM Eval - CLIcK80.25Accuracy (%, 0-shot)0
Korean LLM Eval - HAE-RAE Bench84.92Accuracy (%, 0-shot)0
Korean LLM Eval - KMMLU-HARD56.92Accuracy (%, 0-shot)0
Korean LLM Eval - KMMLU-Pro66.19Accuracy (%, 0-shot)0
Korean LLM Eval - KoBALT-70048.86Accuracy (%, 0-shot)0
Korean LLM Eval - MuSR (Ko)57.33Accuracy (%, 0-shot)0

Interactive version: theaggregate.ai/model?slug=deepseek-v4-flash-0731-non-reasoning · How It Works · Data refreshed daily, snapshot 2026-09-05.