Llama 2 13B LoRA Assemble: benchmark results

Provider: Meta. Access: Open.

Unified ELO 1420 ± 10, rank #1974 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - TruthfulQA MC140.39Accuracy (%)96
MMLU-by-task - TruthfulQA MC255.96Accuracy (%)94.3
MMLU-by-task - Moral Scenarios48.49Accuracy (%)94.2
MMLU-by-task - College Computer Science54Accuracy (%)93.4
MMLU-by-task - High School Chemistry48.77Accuracy (%)92.1
MMLU-by-task - College Medicine59.54Accuracy (%)91.9
MMLU-by-task - Professional Medicine61.03Accuracy (%)91.6
MMLU-by-task - Electrical Engineering56.55Accuracy (%)91.5
Open Korean LLM - KorNAT-Harmless67.92Normalized accuracy (%)91
MMLU-by-task - High School Government And Politics88.08Accuracy (%)90.9
MMLU-by-task - High School Mathematics32.59Accuracy (%)90.6
MMLU-by-task - High School US History83.33Accuracy (%)90.5

Interactive version: theaggregate.ai/model?slug=llama-2-13b-lora-assemble · How It Works · Data refreshed daily, snapshot 2026-09-23.