Lumina-3.5: benchmark results

Provider: Other. Released 2025-07-01. Access: Open.

Unified ELO 1476 ± 15, rank #1500 of 2928 rated models, from 17 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Open LLM Leaderboard v1 - TruthfulQA MC275.66MC2 (%) (0-shot)95.7
Open LLM Leaderboard v1 - HellaSwag88.82Normalized accuracy (%) (10-shot)94.2
Open LLM Leaderboard v1 - WinoGrande83.98Accuracy (%) (5-shot)91.4
Open LLM Leaderboard v1 - ARC Challenge71.59Normalized accuracy (%) (25-shot)89.6
Open LLM Leaderboard v1 - GSM8K67.93Accuracy (%) (5-shot)84.8
Open Medical LLM - MMLU College Medicine67.05Accuracy (%)82.1
Open LLM Leaderboard v1 - MMLU64.48Accuracy (%) (5-shot)71.1
Open Medical LLM - MMLU Clinical Knowledge70.94Accuracy (%)50.3
Open Medical LLM - MMLU Anatomy59.26Accuracy (%)46.3
Open Medical LLM - PubMedQA73.6Accuracy (%)43.8
Open Medical LLM63.72Average Accuracy (%)40.9
Open Medical-LLM Leaderboard63.72Medical average (%)40

Interactive version: theaggregate.ai/model?slug=lumina-3-5 · How It Works · Data refreshed daily, snapshot 2026-09-23.