Llama 4 Scout Base — benchmark results

Base Llama 4 Scout checkpoint. Provider: Meta. Released 2025-04-05. Access: Open.

Unified ELO 1460 ± 12, rank #954 of 1776 rated models, from 634 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MEGA-Bench Task - Flowchart Code Generation77.8Task Score (%)100
MEGA-Bench Task - OCR Resume Employer Plain78.6Task Score (%)98.8
MEGA-Bench Task - Places365 Scene Type Classification100Task Score (%)98.8
EuroEval Swedish NLU - Swerec80.1Sentiment classification Score (%)95.9
MEGA-Bench Task - Annoying Word Search0.4Task Score (%)95.3
MEGA-Bench Task - Camera Trajectory To Video Selection64.3Task Score (%)94.2
MEGA-Bench Task - GUI Act Web Single7.8Task Score (%)93
MEGA-Bench Task - Graph Hamiltonian Cycle52.4Task Score (%)93
MEGA-Bench Task - Long String Letter Recognition21.4Task Score (%)93
MEGA-Bench Task - OCR Math Equation71.4Task Score (%)93
MEGA-Bench Task - Remaining Playback Time Calculation28.6Task Score (%)93
MEGA-Bench Task - CLEVR Arithmetic68.4Task Score (%)91.9

Interactive version: theaggregate.ai/model?slug=llama-4-scout-base · How the rankings work · Data refreshed daily, snapshot 2026-07-22.