Llama 3.2 11B: benchmark results

Provider: Meta. Released 2024-09-25. Access: Open.

Unified ELO 1389 ± 13, rank #1241 of 1629 rated models, from 608 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MEGA-Bench Task - Bridge Strategies Expert47.1Task Score (%)100
MEGA-Bench Task - Graph Hamiltonian Path48.2Task Score (%)100
MEGA-Bench Task - Red Teaming Celebrity90Task Score (%)98.8
MEGA-Bench Task - Constrained Generation Xor Images100Task Score (%)98.1
MEGA-Bench Task - Bridge Strategies World-Class44.3Task Score (%)97.7
MEGA-Bench Task - MMSoc Memotion68.2Task Score (%)96.5
MEGA-Bench Task - Multiview Reasoning Camera Moving64.3Task Score (%)88.4
MEGA-Bench Task - MFC Bench Check Clip Stable Diffusion Generate57.1Task Score (%)82.7
MEGA-Bench Task - Number Comparison100Task Score (%)82.6
MEGA-Bench Task - Video Camera Motion Description28.6Task Score (%)82.6
MEGA-Bench Task - Bridge Strategies Advanced22.9Task Score (%)80.2
MEGA-Bench Task - Visual Prediction Rater Novel View Synthesis14.3Task Score (%)79.1

Interactive version: theaggregate.ai/model?slug=llama-3-2-11b · How It Works · Data refreshed daily, snapshot 2026-10-07.