vicuna-13B — benchmark results
Provider: LMSYS. Released 2023-04-03. Access: Open.
Unified ELO 1253 ± 11, rank #1610 of 1776 rated models, from 74 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| MMLU-by-task - TruthfulQA MC2 | 52.68 | Accuracy (%) | 88.2 |
| MMLU-by-task - College Chemistry | 44 | Accuracy (%) | 86.5 |
| MMLU-by-task - TruthfulQA MC1 | 36.11 | Accuracy (%) | 85.3 |
| MMLU-by-task - High School Physics | 35.76 | Accuracy (%) | 84.4 |
| MMLU-by-task - Global Facts | 38 | Accuracy (%) | 81.6 |
| MMLU-by-task - Anatomy | 49.63 | Accuracy (%) | 75.8 |
| MMLU-by-task - Astronomy | 54.61 | Accuracy (%) | 73.4 |
| MMLU-by-task - Professional Medicine | 52.94 | Accuracy (%) | 73.1 |
| MMLU-by-task - Formal Logic | 35.71 | Accuracy (%) | 72.6 |
| MMLU-by-task - Virology | 45.18 | Accuracy (%) | 70.2 |
| MMLU-by-task - Sociology | 71.64 | Accuracy (%) | 70.1 |
| MMLU-by-task - Human Sexuality | 61.07 | Accuracy (%) | 68 |
Interactive version: theaggregate.ai/model?slug=vicuna-13b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.