opt-30B — benchmark results

Provider: Meta. Released 2022-05-11. Access: Open.

Unified ELO 1149 ± 20, rank #1738 of 1776 rated models, from 79 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - High School Statistics42.13Accuracy (%)63.1
MMLU-by-task - Moral Scenarios27.6Accuracy (%)62
ToolBench - WebShop Long0Task Score44.2
MMLU-by-task - College Computer Science35Accuracy (%)41.9
MMLU-by-task - HellaSwag54.92Accuracy (%)39.8
MMLU-by-task - High School Physics28.48Accuracy (%)39.1
MMLU-by-task - High School US History30.88Accuracy (%)34.5
MMLU-by-task - Security Studies36.33Accuracy (%)34
MMLU-by-task - World Religions35.67Accuracy (%)34
MMLU-by-task - ARC Challenge39.42Accuracy (%)33.5
MMLU-by-task - College Mathematics29Accuracy (%)32.7
ToolBench - Google Sheets8.6Task Score32.6

Interactive version: theaggregate.ai/model?slug=opt-30b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.