DeepSeek V3.1 NEX N1: benchmark results

Provider: DeepSeek. Released 2025-12-08. Access: Open.

Unified ELO 1702 ± 33, rank #329 of 2656 rated models, from 77 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AGC-Bench - ocw_connections1.1Dataset z-score95.1
AGC-Bench - poetmt1.25Dataset z-score91.4
AGC-Bench - cpers1.05Dataset z-score90.2
AGC-Bench - scar0.86Dataset z-score90.2
AGC-Bench - schnovel1.2Dataset z-score89.6
AGC-Bench - STEM0.54JRT z-score87.8
AGC-Bench - grapheval_review_advisor1.06Dataset z-score87.8
AGC-Bench - conceptual_design0.96Dataset z-score85.4
AGC-Bench - tinyfabulist0.92Dataset z-score85.4
AGC-Bench - slang_generation0.92Dataset z-score84.1
AGC-Bench - rpgbench1.06Dataset z-score84
AGC-Bench - brainteaser0.86Dataset z-score83.5

Interactive version: theaggregate.ai/model?slug=deepseek-v3-1-nex-n1 · How It Works · Data refreshed daily, snapshot 2026-09-19.