Inkling: benchmark results
Thinking Machines Lab's first open-weights model, a 975B-A41B multimodal MoE with controllable thinking effort. Provider: Thinking Machines. Released 2026-07-15. Access: Open.
Unified ELO 1679 ± 1, rank #85 of 1392 rated models, from 141 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| Enkrypt AI - Jailbreak Risk | 0.72 | Risk Score | 98.7 |
| Nejumi 4 - ALT - Controllability | 93.54 | Score (%) | 98.4 |
| Nejumi 4 - GLP - Expression | 99.33 | Score (%) | 98.4 |
| Nejumi 4 - GLP - Logical Reasoning | 96.5 | Score (%) | 98 |
| Nejumi 4 - GLP - Applied Language | 90.62 | Score (%) | 97.5 |
| Enkrypt AI - Insecure Code Risk | 2.22 | Risk Score | 96.8 |
| MMAU | 77.2 | Avg Test (self-reported) | 96.7 |
| Nejumi 4 - MT-Bench (Japanese) | 98.38 | Score (%) | 96.7 |
| Enkrypt AI - Risk Score | 15.22 | Risk Score | 96.6 |
| AudioMC | 56.6 | Score (self-reported) | 96.3 |
| Vals AI CorpFin v2 | 68.57 | Accuracy (%) | 95.5 |
| Humanity's Last Exam (Self-Reported, No Tools) | 46 | Accuracy (%) | 94.1 |
Interactive version: theaggregate.ai/model?slug=inkling · How It Works · Data refreshed daily, snapshot 2026-09-05.