Llama 3 8B Ita — benchmark results
DeepMount00's Italian-language fine-tune of Meta's Llama 3 8B, optimized for Italian conversation and text generation. Provider: Meta. Released 2024-04-18. Access: Open.
Unified ELO 1446 ± 9, rank #1016 of 1776 rated models, from 44 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Open Medical LLM - PubMedQA | 78.4 | Accuracy (%) | 97.4 |
| Open Italian LLM - MMLU-Pro (IT) | 30.7 | Accuracy (%) | 96.4 |
| Open Korean LLM Leaderboard | 536.18 | Average Score (%) | 91 |
| Open LLM Leaderboard - IFEval | 75.3 | Score | 90.7 |
| Open Medical LLM - MMLU College Biology | 80.56 | Accuracy (%) | 88.6 |
| Open Medical LLM - MMLU Medical Genetics | 83 | Accuracy (%) | 85.8 |
| Open Chinese LLM - TruthfulQA MC | 58.91 | Accuracy (%) | 79.5 |
| Open Medical LLM - MedQA (USMLE) | 60.72 | Accuracy (%) | 77.3 |
| Open Medical LLM - MedMCQA | 57.04 | Accuracy (%) | 76.4 |
| Open Medical LLM | 70.11 | Average Accuracy (%) | 76.1 |
| Pinocchio Italian - Logica | 44.6 | Accuracy (%) | 75 |
| Pinocchio Italian Leaderboard | 56.37 | Average Accuracy (%) | 75 |
Interactive version: theaggregate.ai/model?slug=llama-3-8b-ita · How the rankings work · Data refreshed daily, snapshot 2026-07-22.