Llama 3 8B Ita — benchmark results

DeepMount00's Italian-language fine-tune of Meta's Llama 3 8B, optimized for Italian conversation and text generation. Provider: Meta. Released 2024-04-18. Access: Open.

Unified ELO 1446 ± 9, rank #1016 of 1776 rated models, from 44 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open Medical LLM - PubMedQA78.4Accuracy (%)97.4
Open Italian LLM - MMLU-Pro (IT)30.7Accuracy (%)96.4
Open Korean LLM Leaderboard536.18Average Score (%)91
Open LLM Leaderboard - IFEval75.3Score90.7
Open Medical LLM - MMLU College Biology80.56Accuracy (%)88.6
Open Medical LLM - MMLU Medical Genetics83Accuracy (%)85.8
Open Chinese LLM - TruthfulQA MC58.91Accuracy (%)79.5
Open Medical LLM - MedQA (USMLE)60.72Accuracy (%)77.3
Open Medical LLM - MedMCQA57.04Accuracy (%)76.4
Open Medical LLM70.11Average Accuracy (%)76.1
Pinocchio Italian - Logica44.6Accuracy (%)75
Pinocchio Italian Leaderboard56.37Average Accuracy (%)75

Interactive version: theaggregate.ai/model?slug=llama-3-8b-ita · How the rankings work · Data refreshed daily, snapshot 2026-07-22.