Inkling: benchmark results

Thinking Machines Lab's first open-weights model, a 975B-A41B multimodal MoE with controllable thinking effort. Provider: Thinking Machines. Released 2026-07-15. Access: Open.

Unified ELO 1679 ± 1, rank #85 of 1392 rated models, from 141 benchmark results.

Strongest benchmark results

BenchmarkScoreMetricPercentile
Enkrypt AI - Jailbreak Risk0.72Risk Score98.7
Nejumi 4 - ALT - Controllability93.54Score (%)98.4
Nejumi 4 - GLP - Expression99.33Score (%)98.4
Nejumi 4 - GLP - Logical Reasoning96.5Score (%)98
Nejumi 4 - GLP - Applied Language90.62Score (%)97.5
Enkrypt AI - Insecure Code Risk2.22Risk Score96.8
MMAU77.2Avg Test (self-reported)96.7
Nejumi 4 - MT-Bench (Japanese)98.38Score (%)96.7
Enkrypt AI - Risk Score15.22Risk Score96.6
AudioMC56.6Score (self-reported)96.3
Vals AI CorpFin v268.57Accuracy (%)95.5
Humanity's Last Exam (Self-Reported, No Tools)46Accuracy (%)94.1

Interactive version: theaggregate.ai/model?slug=inkling · How It Works · Data refreshed daily, snapshot 2026-09-05.