Llama 4 Maverick: benchmark results

Meta's open Llama 4 Maverick, a 400B sparse MoE (17B active) multimodal model (April 2025). Provider: Meta. Released 2025-04-05. Access: Open.

Unified ELO 1567 ± 1, rank #377 of 1392 rated models, from 649 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
PCB-Bench - Task 3 Precision91.23Precision (%)100
AGC-Bench - fann_or_flop1.74Dataset z-score97.6
BigCodeBench49.7Pass@1 (%)97.6
LLM Stats (ChartQA)90Score (%)96
ChineseSafe Benchmark75.02Accuracy (%)94.4
AGC-Bench - ocw1.53Dataset z-score93.9
Phare - Bias Resistance73.65Score (%)93.9
TableVista54.7Avg. (self-reported)92.9
PCB-Bench - Placement Macro QA SBERT49.31SBERT similarity (%)91.7
PCB-Bench - Routing Macro QA SBERT51.49SBERT similarity (%)91.7
Evals for Every Language - Language apc54.91Average Score (%)91.3
AA Omniscience - Software Engineering (SWE) - Julia32Accuracy (%)90.1

Interactive version: theaggregate.ai/model?slug=llama-4-maverick · How It Works · Data refreshed daily, snapshot 2026-09-05.