GPT-5.1-Codex-Max
2025-11-19 · Éditeur : OpenAI · Domaine : Intelligence Artificielle
OpenAI lance GPT-5.1-Codex-Max, son nouveau modèle de développement agentique, entraîné à travailler sur plusieurs fenêtres de contexte grâce à la compaction, pour des tâches de plusieurs heures.
Ce qui change
- Premier modèle entraîné nativement à opérer sur plusieurs fenêtres de contexte via la compaction : il élague son historique tout en gardant l'essentiel et travaille sur des millions de tokens.
- Observé travaillant seul plus de 24 heures sur des tâches internes.
- Environ 30 % de tokens de réflexion en moins que GPT-5.1-Codex à effort moyen pour de meilleurs résultats, et nouvel effort « xhigh ».
- Premier modèle entraîné pour les environnements Windows.
- Remplace GPT-5.1-Codex comme modèle par défaut dans Codex.
OpenAI lance GPT-5.1-Codex-Max, son nouveau modèle de développement agentique, entraîné à travailler sur plusieurs fenêtres de contexte grâce à la compaction, pour des tâches de plusieurs heures. ### Ce qui change - Premier modèle entraîné nativement à opérer sur plusieurs fenêtres de contexte via la compaction : il élague son historique tout en gardant l'essentiel et travaille sur des millions de tokens. - Observé travaillant seul plus de 24 heures sur des tâches internes. - Environ 30 % de tokens de réflexion en moins que GPT-5.1-Codex à effort moyen pour de meilleurs résultats, et nouvel effort « xhigh ». - Premier modèle entraîné pour les environnements Windows. - Remplace GPT-5.1-Codex comme modèle par défaut dans Codex. ### Caractéristiques - Contexte 400 000 tokens (compaction au-delà), sortie 128 000 tokens, entrée texte et image, sortie texte, coupure 30 septembre 2024. - Disponible dans Codex (CLI, IDE, cloud, revue de code) pour ChatGPT Plus, Pro, Business, Edu et Enterprise. - API Responses (gpt-5.1-codex-max) le 4 décembre 2025. - Ne dépasse pas le niveau « High » en cybersécurité, mais est le modèle le plus capable de l'éditeur dans ce domaine à cette date. ### Tarifs Mêmes tarifs que GPT-5.1-Codex. | | Entrée | Entrée en cache | Sortie | | --- | --- | --- | --- | | gpt-5.1-codex-max | 1,25 | 0,125 | 10 | ### Benchmarks Scores publiés par l'éditeur, avec compaction et effort très élevé (xhigh), contre GPT-5.1-Codex (high). | Benchmark | GPT-5.1-Codex-Max | GPT-5.1-Codex | | --- | --- | --- | | SWE-bench Verified (500 tâches) | 77,9 % | 73,7 % | | SWE-Lancer IC SWE | 79,9 % | 66,3 % | | Terminal-Bench 2.0 | 58,1 % | 52,8 % | ### À retenir Le modèle vise les refontes de projet et les boucles d'agents de plusieurs heures. L'éditeur indique que 95 % de ses ingénieurs utilisent Codex chaque semaine et livrent environ 70 % de demandes de fusion en plus.
Liens
Tags : LLM, OpenAI, Codex, GPT-5.1, Code, Agent