GPT-4.1 Nano — benchmark results
OpenAI's smallest, fastest, cheapest GPT-4.1 tier, keeping the family's 1M-token context for low-latency classification and autocomplete. Provider: OpenAI. Released 2025-04-14. Access: API.
Unified ELO 1452 ± 5, rank #983 of 1776 rated models, from 946 benchmark results.
Strongest benchmark results
| Benchmark | Score | Metric | Percentile |
|---|---|---|---|
| OpenVLM MMT-Bench - One Shot Detection | 95 | Score (%) | 99 |
| EuroEval Dutch Simplification - Duidelijke Taal | 57.78 | Score (%) | 98.9 |
| OpenVLM MMT-Bench - Furniture Keypoint Detection | 75 | Score (%) | 98.5 |
| OpenVLM MMT-Bench - CIM | 76.7 | Score (%) | 97.3 |
| OpenVLM MMT-Bench - Traffic Light Understanding | 100 | Score (%) | 96.4 |
| EuroEval Bosnian | 56.05 | Average Score (%) | 94.8 |
| OpenVLM MMT-Bench - Point Tracking | 85 | Score (%) | 93.9 |
| OpenVLM MMT-Bench - Clock Reading | 75 | Score (%) | 93.7 |
| OpenVLM MMMU - Chemistry | 66.7 | Accuracy (%) | 92.6 |
| OpenVLM MMT-Bench - Traffic Participants Understanding | 65 | Score (%) | 92.5 |
| EuroEval Icelandic NLU - Hotter and Colder Sentiment | 55.79 | Sentiment classification Score (%) | 92.3 |
| OpenVLM MMMU - Finance | 76.7 | Accuracy (%) | 91.7 |
Interactive version: theaggregate.ai/model?slug=gpt-4-1-nano · How the rankings work · Data refreshed daily, snapshot 2026-07-22.