INTELLECT-3: benchmark results

Prime Intellect's open 106B A12B reasoning MoE, RL-trained from GLM-4.5-Air. Provider: PrimeIntellect. Released 2025-12-01. Access: Open.

Unified ELO 1573 ± 1, rank #347 of 1392 rated models, from 107 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Medmarks - MedHallu Easy70.67Score (%)87.1
AA LiveCodeBench77.67Pass@1 (%)86.9
AA AIME 202588Accuracy (%)86.5
Medmarks - HEAD-QA v288.3Score (%)85.7
Medmarks - MedQA90.52Score (%)84.3
Medmarks - MedConceptsQA Easy97.95Score (%)82.9
Medmarks - LongHealth Task 188.67Score (%)82.1
Medmarks - CareQA EN90.65Score (%)81.4
Medmarks - MMLU-Pro Health76.69Score (%)81.4
Medmarks - MedConceptsQA Medium74.1Score (%)81.4
Medmarks - MedXpertQA Reasoning31.4Score (%)81.4
Medmarks - MedXpertQA Understanding30.5Score (%)81.4

Interactive version: theaggregate.ai/model?slug=intellect-3 · How It Works · Data refreshed daily, snapshot 2026-09-05.