Molmo2-8B — benchmark results

Provider: Allen AI. Released 2025-03-13. Access: Open.

Unified ELO 1380 ± 59, rank #1313 of 1776 rated models, from 42 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
GQA87.07Overall Accuracy (%)99.8
Chatbot Arena (Text)1328Elo44.1
AA Omniscience - Software Engineering (SWE) - Dart18Accuracy (%)40.7
AA Omniscience - Software Engineering (SWE) - PHP18Accuracy (%)34.7
CritPt0Accuracy (self-reported)30.3
AA Omniscience - Software Engineering (SWE) - HTML24Accuracy (%)29.2
TableVista39.9Avg. (self-reported)28.6
AA CritPt0Accuracy (%)27.1
AA Omniscience - Software Engineering (SWE) - Go10Accuracy (%)24.7
AA Omniscience - Software Engineering (SWE) - Python13Accuracy (%)24.4
Chatbot Arena (Vision)1108Arena Score23.1
AA Omniscience - Software Engineering (SWE) - JavaScript20.91Accuracy (%)23

Interactive version: theaggregate.ai/model?slug=molmo2-8b · How the rankings work · Data refreshed daily, snapshot 2026-07-22.