Llama 3.2 11B Vision: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1438 ± 28, rank #1613 of 2653 rated models, from 11 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Portuguese LLM - OAB Exams52.39Accuracy (%)81.7
TRAP25.9Overall HM (self-reported)81
Open Portuguese LLM - ENEM71.59Accuracy (%)80.8
Open Portuguese LLM - BLUEX60.36Accuracy (%)78.4
Open Portuguese LLM - ASSIN2 RTE91.86Macro F1 (%)71.2
Open Portuguese LLM - FaQuAD NLI62.1Macro F1 (%)46.6
SeePhys8.3Total Accuracy (%)14.3
MMSI-Bench25.4Accuracy (%)7.9
SciTrue - Claim Attribution34.7Accuracy (%)0
SciTrue - Claim Validation48.6F1 (%)0
SciTrue - Evidence Pairing10.8Accuracy (%)0

Interactive version: theaggregate.ai/model?slug=llama-3-2-11b-vision · How It Works · Data refreshed daily, snapshot 2026-09-21.