gpt-neo-2.7B: benchmark results

Provider: OpenAI. Released 2021-03-21. Access: API.

Unified ELO 1229 ± 9, rank #2845 of 2928 rated models, from 96 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
MMLU-by-task - Moral Scenarios26.48Accuracy (%)54.5
MMLU-by-task - High School Statistics39.35Accuracy (%)53.1
MMLU-by-task - Elementary Mathematics29.1Accuracy (%)52.3
MMLU-by-task - Professional Medicine43.01Accuracy (%)37.7
MMLU-by-task - High School Computer Science35Accuracy (%)37.1
MMLU-by-task - College Physics22.55Accuracy (%)34.2
MMLU-by-task - Abstract Algebra27Accuracy (%)34
MMLU-by-task - High School Macroeconomics34.36Accuracy (%)33.3
MMLU-by-task - Nutrition31.7Accuracy (%)33.1
MMLU-by-task - Econometrics26.32Accuracy (%)32.7
MMLU-by-task - Philosophy31.51Accuracy (%)32.2
MMLU-by-task - Prehistory30.86Accuracy (%)31.9

Interactive version: theaggregate.ai/model?slug=gpt-neo-2-7b · How It Works · Data refreshed daily, snapshot 2026-09-23.