Llama 3.3 Nemotron Super 49B v1 (Non-reasoning) — benchmark results

Llama 3.3 Nemotron Super 49B v1 evaluated with reasoning disabled. Provider: NVIDIA. Released 2025-03-18. Access: Open.

Unified ELO 1460 ± 32, rank #956 of 1776 rated models, from 36 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA MATH-50077.53Accuracy (%)43.1
AA Omniscience - Software Engineering (SWE) - PHP20Accuracy (%)40.8
AA Omniscience-49.68Score38.8
AA IFBench39.46Accuracy (%)37.1
AA MMLU-Pro69.77Accuracy (%)36
AA Omniscience - Software Engineering (SWE) - Java14Accuracy (%)35.2
AA Omniscience - Software Engineering (SWE) - HTML26Accuracy (%)34.9
AA Omniscience - Software Engineering (SWE) - C28Accuracy (%)34.4
AA Omniscience - Software Engineering (SWE) - Go12Accuracy (%)32.6
AA Omniscience - Software Engineering (SWE) - Rust42Accuracy (%)32.4
AA Omniscience - Health15.2Accuracy (%)32.3
AA LiveCodeBench28.04Pass@1 (%)31.4

Interactive version: theaggregate.ai/model?slug=llama-3-3-nemotron-super-49b-v1-non-reasoning · How the rankings work · Data refreshed daily, snapshot 2026-07-22.