Llama 4 Maverick: benchmark results
Meta's open Llama 4 Maverick, a 400B sparse MoE (17B active) multimodal model (April 2025). Provider: Meta. Released 2025-04-05. Access: Open.
Unified ELO 1567 ± 1, rank #377 of 1392 rated models, from 649 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| PCB-Bench - Task 3 Precision | 91.23 | Precision (%) | 100 |
| AGC-Bench - fann_or_flop | 1.74 | Dataset z-score | 97.6 |
| BigCodeBench | 49.7 | Pass@1 (%) | 97.6 |
| LLM Stats (ChartQA) | 90 | Score (%) | 96 |
| ChineseSafe Benchmark | 75.02 | Accuracy (%) | 94.4 |
| AGC-Bench - ocw | 1.53 | Dataset z-score | 93.9 |
| Phare - Bias Resistance | 73.65 | Score (%) | 93.9 |
| TableVista | 54.7 | Avg. (self-reported) | 92.9 |
| PCB-Bench - Placement Macro QA SBERT | 49.31 | SBERT similarity (%) | 91.7 |
| PCB-Bench - Routing Macro QA SBERT | 51.49 | SBERT similarity (%) | 91.7 |
| Evals for Every Language - Language apc | 54.91 | Average Score (%) | 91.3 |
| AA Omniscience - Software Engineering (SWE) - Julia | 32 | Accuracy (%) | 90.1 |
Interactive version: theaggregate.ai/model?slug=llama-4-maverick · How It Works · Data refreshed daily, snapshot 2026-09-05.