Llama 4 Maverick — benchmark results

Meta Llama 4 Maverick model row. Provider: Meta. Released 2025-04-05. Access: Open.

Unified ELO 1545 ± 9, rank #636 of 1776 rated models, from 609 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
PCB-Bench - Task 3 Precision91.23Precision (%)100
AGC-Bench - fann_or_flop1.74Dataset z-score97.6
BigCodeBench49.7Pass@1 (%)97.6
LLM Stats (ChartQA)90Score (%)95.7
ChineseSafe Benchmark75.02Accuracy (%)94.4
AGC-Bench - ocw1.53Dataset z-score93.9
TableVista54.7Avg. (self-reported)92.9
PCB-Bench - Placement Macro QA SBERT49.31SBERT similarity (%)91.7
PCB-Bench - Routing Macro QA SBERT51.49SBERT similarity (%)91.7
Evals for Every Language - Language apc54.91Average Score (%)91.3
XL-SafetyBench92Overall ASR (self-reported)88.9
WMT25 English-Maasai chrF++25.4chrF++88.5

Interactive version: theaggregate.ai/model?slug=llama-4-maverick · How the rankings work · Data refreshed daily, snapshot 2026-07-22.