WizardVicuna-open-llama-3B-v2: benchmark results

Provider: Other. Access: Open.

Unified ELO 1252 ± 10, rank #2800 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Physics32.45Accuracy (%)65.9
Open Korean LLM - Ko-GPQA-Diamond24.24Normalized accuracy (%)62.4
MMLU-by-task - College Physics25.49Accuracy (%)53.1
MMLU-by-task - High School Statistics39.35Accuracy (%)53.1
MMLU-by-task - Global Facts33Accuracy (%)51.5
Open Korean LLM - Ko-IFEval26.94Strict accuracy, prompt/instruction mean (%)41.1
MMLU-by-task - Security Studies40.41Accuracy (%)40.7
MMLU-by-task - Moral Scenarios24.69Accuracy (%)39
MMLU-by-task - Professional Accounting29.43Accuracy (%)37.5
MMLU-by-task - Formal Logic26.98Accuracy (%)35.6
MMLU-by-task - Business Ethics35Accuracy (%)34.2
MMLU-by-task - Electrical Engineering31.03Accuracy (%)34.2

Interactive version: theaggregate.ai/model?slug=wizardvicuna-open-llama-3b-v2 · How It Works · Data refreshed daily, snapshot 2026-09-23.