Skip to main content
GitHub CopilotCodexAI automation

Pourquoi Codex est soudainement devenu trop prudent

Les utilisateurs se plaignent que Codex dans Copilot est devenu trop prudent, posant trop de questions avant d'agir. Il n'y a pas de confirmation officielle d'un changement caché, mais c'est un signal clé pour l'automatisation IA : le comportement de l'agent pourrait avoir changé suite aux mises à jour du modèle ou des paramètres, impactant la vitesse et la prévisibilité.

Contexte technique

Je ne m'empresserais pas de crier au « prompt système secret ». D'après les données actuellement disponibles, il n'y a aucune confirmation officielle d'une mise à jour cachée. En revanche, il existe une version bien terre à terre : en mai et juin, GitHub a remanié les modèles dans Copilot, et c'est précisément après de telles réorganisations que l'automatisation IA commence à se comporter « comme si on l'avait échangée ».

Ce que je constate dans les faits : GPT-5.3-Codex est devenu le modèle de base pour une partie des scénarios Copilot, GPT-5.2-Codex a commencé à être retiré, et le déploiement ne s'est pas fait d'un seul coup. C'est dans ces transitions que naissent des effets étranges : hier l'agent était trop autonome, aujourd'hui il ralentit et interroge sur le moindre détail.

J'ai été particulièrement interpellé par le passage sur memory.md et l'introspection entre les threads. Cela ne ressemble plus à un simple bouton ou à un seul mode. Si l'assistant dispose d'une mémoire, d'instructions internes et de différentes surfaces de produit, alors le changement de comportement pourrait très bien provenir non pas d'un « prompt système » pur, mais d'une combinaison d'un nouveau modèle, de la mémoire et de l'orchestration.

Et c'est là que je creuserais non pas du côté des théories, mais de la reproductibilité. Sur quel compte cela a commencé, dans quel mode, sur quelle surface exacte de Copilot, avec quel modèle, ce qui se trouve dans memory.md, et si l'effet disparaît après une réinitialisation du contexte. Sans cela, toutes les discussions sur /plan mode restent au niveau des conversations de conjectures.

Ce que cela change pour les entreprises et l'automatisation

Si vous construisez une intégration IA dans le développement, ce comportement frappe deux endroits à la fois : la vitesse et la prévisibilité. Un agent qui accomplissait auparavant une tâche en un seul passage insère désormais une couche supplémentaire d'approbations. Sur les petites tâches, c'est tout simplement exaspérant. Dans le pipeline de l'équipe, cela devient un impôt caché sur le temps.

À qui cela pourrait-il même être utile ? Aux équipes ayant des exigences strictes en matière de qualité et de modifications sécurisées. Ceux qui y perdent sont ceux qui comptaient sur un flux rapide et semi-autonome de corrections sans dialogue constant.

Je constate régulièrement de tels changements : on change le modèle, tandis que l'architecture IA du processus reste l'ancienne, et soudain tout commence à patiner. Chez Nahornyi AI Lab, nous analysons justement ces goulets d'étranglement en pratique : là où un agent plus autonome est nécessaire, là où il faut des cadres stricts, et là où il vaut mieux repenser entièrement la mémoire et le routage. Si votre Copilot ou votre assistant de code interne ralentit soudainement l'équipe, vous pouvez tranquillement décortiquer le flux de travail et assembler un développement de solutions IA adapté au travail réel, et non aux attentes de la version précédente.

Nous avons récemment couvert le lancement de Codex dans ChatGPT sur Android, où l'assistant est devenu disponible pour le développement mobile pour la première fois. Cette intégration montre comment les capacités de Codex s'étendent, ce qui est directement lié à son comportement, y compris cette tendance à poser des centaines de questions de clarification.

Partager cet article