INTELLECT-3 — benchmark results

Prime Intellect's open 106B A12B reasoning MoE, RL-trained from GLM-4.5-Air. Provider: PrimeIntellect. Released 2025-12-01. Access: Open.

Unified ELO 1596 ± 14, rank #484 of 1776 rated models, from 95 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
AA LiveCodeBench77.67Pass@1 (%)89.3
Medmarks - MedHallu Easy70.67Score (%)87.1
AA AIME 202588Accuracy (%)85.9
Medmarks - HEAD-QA v288.3Score (%)85.7
Medmarks - MedQA90.52Score (%)84.3
Medmarks - MedConceptsQA Easy97.95Score (%)82.9
Medmarks - LongHealth Task 188.67Score (%)82.1
Medmarks - CareQA EN90.65Score (%)81.4
Medmarks - MMLU-Pro Health76.69Score (%)81.4
Medmarks - MedConceptsQA Medium74.1Score (%)81.4
Medmarks - MedXpertQA Reasoning31.4Score (%)81.4
Medmarks - MedXpertQA Understanding30.5Score (%)81.4

Interactive version: theaggregate.ai/model?slug=intellect-3 · How the rankings work · Data refreshed daily, snapshot 2026-07-22.