vicuna-13B-v1.5-16k: benchmark results

Provider: LMSYS. Access: Open.

Unified ELO 1400 ± 20, rank #2144 of 2928 rated models, from 13 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC251.96MC2 (%) (0-shot)53.9
pfgen-bench - QA Mode - Fluency0.57Fluency Score49.7
pfgen-bench - QA Mode - Score0.46pfgen Score (mean of three)41.2
Open LLM Leaderboard v1 - HellaSwag80.37Normalized accuracy (%) (10-shot)40.8
pfgen-bench - QA Mode - Truthfulness0.72Truthfulness Score40.6
Open LLM Leaderboard v1 - ARC Challenge56.74Normalized accuracy (%) (25-shot)36.1
Open LLM Leaderboard v1 - MMLU55.28Accuracy (%) (5-shot)35.9
pfgen-bench - QA Mode - Helpfulness0.1Helpfulness Score35.8
Open LLM Leaderboard v1 - GSM8K13.12Accuracy (%) (5-shot)35
Open LLM Leaderboard v1 - WinoGrande72.38Accuracy (%) (5-shot)29
SALAD-Bench24.78Average Safety Score (%)3
SALAD-Bench Attack3.66Safety Score (%)3

Interactive version: theaggregate.ai/model?slug=vicuna-13b-v1-5-16k · How It Works · Data refreshed daily, snapshot 2026-09-23.