GPT-4.1, GPT-4.1 mini et GPT-4.1 nano
2025-04-14 · Éditeur : OpenAI · Domaine : Intelligence Artificielle
OpenAI lance dans l'API la famille GPT-4.1 (GPT-4.1, mini et nano), avec de meilleures performances en code et en suivi d'instructions, un contexte d'un million de tokens et un premier modèle nano.
Ce qui change
- Trois modèles qui dépassent GPT-4o et GPT-4o mini sur l'ensemble des mesures, avec une coupure de connaissances portée à juin 2024.
- Contexte d'un million de tokens pour les trois modèles (contre 128 000), sans surcoût pour les requêtes longues.
- GPT-4.1 mini égale ou dépasse GPT-4o sur plusieurs évaluations, avec une latence presque divisée par deux et un coût réduit de 83 %.
- GPT-4.1 nano est le modèle le plus rapide et le moins cher d'OpenAI, adapté à la classification et à l'autocomplétion.
- GPT-4.1 n'existe que dans l'API. Le retrait de GPT-4.5 Preview est annoncé pour le 14 juillet 2025.
OpenAI lance dans l'API la famille GPT-4.1 (GPT-4.1, mini et nano), avec de meilleures performances en code et en suivi d'instructions, un contexte d'un million de tokens et un premier modèle nano. ### Ce qui change - Trois modèles qui dépassent GPT-4o et GPT-4o mini sur l'ensemble des mesures, avec une coupure de connaissances portée à juin 2024. - Contexte d'un million de tokens pour les trois modèles (contre 128 000), sans surcoût pour les requêtes longues. - GPT-4.1 mini égale ou dépasse GPT-4o sur plusieurs évaluations, avec une latence presque divisée par deux et un coût réduit de 83 %. - GPT-4.1 nano est le modèle le plus rapide et le moins cher d'OpenAI, adapté à la classification et à l'autocomplétion. - GPT-4.1 n'existe que dans l'API. Le retrait de GPT-4.5 Preview est annoncé pour le 14 juillet 2025. ### Caractéristiques - Contexte 1 047 576 tokens, sortie maximale 32 768 tokens, entrée texte et image, sortie texte, sans étape de raisonnement. - Date de coupure : 1er juin 2024. - Identifiants API : gpt-4.1, gpt-4.1-mini, gpt-4.1-nano (snapshots 2025-04-14) ; réglage fin disponible pour 4.1 et 4.1 mini. ### Tarifs Tarifs par million de tokens (USD) ; réduction de 50 % avec l'API Batch, remise de 75 % sur le cache. | Modèle | Entrée | Entrée en cache | Sortie | | --- | --- | --- | --- | | gpt-4.1 | 2,00 | 0,50 | 8,00 | | gpt-4.1-mini | 0,40 | 0,10 | 1,60 | | gpt-4.1-nano | 0,10 | 0,025 | 0,40 | ### Benchmarks Scores publiés par l'éditeur. | Benchmark | Résultat | | --- | --- | | SWE-bench Verified (GPT-4.1) | 54,6 % (GPT-4o : 33,2 %) | | MultiChallenge (GPT-4.1) | 38,3 % | | IFEval (GPT-4.1) | 87,4 % (GPT-4o : 81,0 %) | | Video-MME, longues vidéos sans sous-titres | 72,0 % | | Graphwalks | 61,7 % | | GPT-4.1 nano : MMLU / GPQA / Aider polyglot | 80,1 % / 50,3 % / 9,8 % | ### À retenir La famille cible les agents et l'analyse de gros volumes documentaires à coût maîtrisé. GPT-4.1 mini est arrivé ensuite dans ChatGPT à la place de GPT-4o mini (14 mai 2025).
Liens
Tags : LLM, OpenAI, GPT, GPT-4.1, Contexte long, API