DeepSeek V2 Chat — benchmark results

Provider: DeepSeek. Released 2024-05-06. Access: Open.

Unified ELO 1593 ± 38, rank #495 of 1776 rated models, from 10 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - ASSIN2 STS85.33Pearson Correlation (×100)97.6
RepoQA83.4Score (self-reported)84.4
WildBench48.21WB Score Task-Macro74.2
BigCodeBench40.4Pass@1 (%)59.9
Open Portuguese LLM - HateBR Offensive88.43F1 (%)51.2
BenchTable49.2Total Score (%)51
Open Portuguese LLM - Hate Speech72.72F1 (%)39
SEAL - Chinese996Score35
Open Portuguese LLM Leaderboard77.06Average Score (%)17.1
Open Portuguese LLM - TweetSentBR68.35F1 (%)7.3

Interactive version: theaggregate.ai/model?slug=deepseek-v2-chat · How the rankings work · Data refreshed daily, snapshot 2026-07-22.