OPT-66B: benchmark results

Provider: Meta. Released 2022-06-22. Access: Open.

Unified ELO 1215 ± 53, rank #2620 of 2656 rated models, from 40 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
HELM Classic - MS MARCO TREC48.2NDCG@10 (%)70
HELM Classic - Synthetic Reasoning Natural21.29F1 (%)63.2
HELM Classic - BLiMP82.67Exact Match (%)61.3
HELM Classic - XSUM12.62ROUGE-2 (%)61
HELM Classic - BoolQ76.03Exact Match (%)56.1
HELM Classic - MS MARCO Regular23.71RR@10 (%)55.2
HELM Classic - HellaSwag74.5Exact Match (%)54.8
HELM Classic - LegalSupport52.69Exact Match (%)52.9
HELM Classic - QuAC35.66F1 (%)50.8
HELM Classic - CNN/DailyMail13.6ROUGE-2 (%)48.8
HELM Classic - OpenbookQA53.4Exact Match (%)48.4
HELM Classic - NaturalQuestions Closed Book25.79F1 (%)47

Interactive version: theaggregate.ai/model?slug=opt-66b · How It Works · Data refreshed daily, snapshot 2026-09-19.