WizardVicuna-3B-0719: benchmark results

Provider: Other. Access: Open.

Unified ELO 1235 ± 10, rank #2830 of 2928 rated models, from 78 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - College Physics24.51Accuracy (%)48
MMLU-by-task - TruthfulQA MC127.29Accuracy (%)45.3
MMLU-by-task - Moral Scenarios24.8Accuracy (%)41.7
Open Korean LLM - Ko-GPQA-Diamond22.73Normalized accuracy (%)40.8
MMLU-by-task - Abstract Algebra28Accuracy (%)39.6
Open Korean LLM - Ko-IFEval26.54Strict accuracy, prompt/instruction mean (%)39.2
Open Korean LLM - KorNAT-Helpful45.48Normalized accuracy (%)37.1
MMLU-by-task - Conceptual Physics32.77Accuracy (%)33.3
MMLU-by-task - College Medicine30.06Accuracy (%)32.7
MMLU-by-task - Moral Disputes30.06Accuracy (%)31.9
MMLU-by-task - HellaSwag50.48Accuracy (%)31.3
MMLU-by-task - ARC Challenge38.4Accuracy (%)31.1

Interactive version: theaggregate.ai/model?slug=wizardvicuna-3b-0719 · How It Works · Data refreshed daily, snapshot 2026-09-23.