vicuna-33B-v1.3 — benchmark results

Provider: LMSYS. Released 2023-06-21. Access: Open.

Unified ELO 1286 ± 15, rank #1563 of 1776 rated models, from 74 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - TruthfulQA MC256.16Accuracy (%)94.8
MMLU-by-task - Marketing87.61Accuracy (%)92.7
MMLU-by-task - Human Sexuality74.05Accuracy (%)91.7
MMLU-by-task - High School World History82.7Accuracy (%)90.7
MMLU-by-task - Clinical Knowledge64.15Accuracy (%)90.4
MMLU-by-task - Machine Learning46.43Accuracy (%)90.4
MMLU-by-task - Professional Law47.52Accuracy (%)90.4
MMLU-by-task - Sociology81.59Accuracy (%)90.4
MMLU-by-task - Professional Psychology64.71Accuracy (%)90
MMLU-by-task - College Computer Science51Accuracy (%)89.7
MMLU-by-task - TruthfulQA MC136.96Accuracy (%)89.7
MMLU-by-task - Moral Disputes68.5Accuracy (%)89.4

Interactive version: theaggregate.ai/model?slug=vicuna-33b-v1-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.