Llama 3.2 11B Vision: benchmark results
Provider: Meta. Access: Open.
Unified ELO 1438 ± 28, rank #1613 of 2653 rated models, from 11 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Portuguese LLM - OAB Exams | 52.39 | Accuracy (%) | 81.7 |
| TRAP | 25.9 | Overall HM (self-reported) | 81 |
| Open Portuguese LLM - ENEM | 71.59 | Accuracy (%) | 80.8 |
| Open Portuguese LLM - BLUEX | 60.36 | Accuracy (%) | 78.4 |
| Open Portuguese LLM - ASSIN2 RTE | 91.86 | Macro F1 (%) | 71.2 |
| Open Portuguese LLM - FaQuAD NLI | 62.1 | Macro F1 (%) | 46.6 |
| SeePhys | 8.3 | Total Accuracy (%) | 14.3 |
| MMSI-Bench | 25.4 | Accuracy (%) | 7.9 |
| SciTrue - Claim Attribution | 34.7 | Accuracy (%) | 0 |
| SciTrue - Claim Validation | 48.6 | F1 (%) | 0 |
| SciTrue - Evidence Pairing | 10.8 | Accuracy (%) | 0 |
Interactive version: theaggregate.ai/model?slug=llama-3-2-11b-vision · How It Works · Data refreshed daily, snapshot 2026-09-21.