DeepSeek V2 Chat: benchmark results

Provider: DeepSeek. Released 2024-05-06. Access: Open.

Unified ELO 1526 ± 1, rank #570 of 1392 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 STS85.33Pearson Correlation (×100)97.6
RepoQA83.4Score (self-reported)84.4
WildBench48.21WB Score Task-Macro74.2
BigCodeBench40.4Pass@1 (%)59.9
Open Portuguese LLM - HateBR Offensive88.43F1 (%)51.2
BenchTable49.2Total Score (%)51
Open Portuguese LLM - Hate Speech72.72F1 (%)39
SEAL - Chinese996Score35
Open Portuguese LLM Leaderboard77.06Average Score (%)17.1
Artificial Analysis Intelligence Index1Intelligence Index9.4
Open Portuguese LLM - TweetSentBR68.35F1 (%)7.3

Interactive version: theaggregate.ai/model?slug=deepseek-v2-chat · How It Works · Data refreshed daily, snapshot 2026-09-05.