3 min de lecture

Codex sait désormais chercher dans l’historique des longues sessions

Codexуправление контекстомавтономные агенты

Codex a ajouté un mode expérimental de gestion du contexte qui remplace la compression répétée des échanges par des notes structurées, une recherche dans l’historique et l’outil new_context. C’est important, car les agents de longue durée peuvent conserver exigences et résultats d’outils entre plusieurs fenêtres de contexte.

Codex change sa manière de gérer les contextes longs

Ce qui retient l’attention n’est pas le mot compact lui-même, mais l’évolution du mécanisme de mémoire : Codex a reçu un mode expérimental avec des notes structurées et une recherche dans l’ancien historique de session. Le journal des modifications de ChatGPT/Codex et la référence de configuration d’OpenAI indiquent que ce mode conserve les détails accumulés entre les fenêtres de contexte et ajoute l’outil new_context. Au lieu de produire un nouveau résumé de toute la conversation, l’agent peut ouvrir une nouvelle fenêtre et retrouver, si nécessaire, les messages précédents ou les résultats d’outils.

Dans un message utilisateur, le mode s’active avec la commande codex features enable context_management.experimental_mode. L’option de configuration documentée définit features.context_management.experimental_mode sur true. Au 5 septembre 2026, la fonction est désactivée par défaut et réservée aux sessions éligibles ChatGPT Plus, Pro et Pro Lite sur le backend Codex, et non aux sessions avec clé API ou fournisseurs tiers.

La logique est saine. Les notes conservent les faits stables, tandis que la recherche ramène les détails qui n’y figurent pas : une ancienne exigence, une décision de planification ou une conclusion d’outil. Pour le codage autonome, c’est plus pratique que le cycle consistant à compresser, oublier une partie, puis continuer, surtout lorsqu’une tâche traverse plusieurs fenêtres de contexte.

Un utilisateur a lancé une exécution nocturne afin de tester le mode sur un contexte long. Un autre a signalé séparément que le texte était devenu nettement plus lisible : les plans de recherche et les synthèses complexes peuvent désormais être examinés sans compétences supplémentaires. Il n’existe toutefois pas encore de chiffres officiels sur la qualité de l’experimental mode ; il s’agit donc pour l’instant d’une idée de conception solide et d’un premier signal UX, pas d’un gain prouvé par les benchmarks.

Les longues tâches agentiques gagnent une mémoire plus robuste

Le changement principal est simple : l’agent n’est plus obligé de faire tenir tout l’historique utile dans un unique résumé sans cesse réécrit. Cela réduit le risque de perdre une décision, une contrainte ou un résultat d’outil simplement parce qu’ils n’ont pas survécu à la compression suivante. Les longs refactorings, les tâches de recherche et les cycles de débogage aux plans mouvants devraient en profiter le plus.

Je regarderais d’abord la précision de la recherche et la qualité des notes elles-mêmes. Si l’agent enregistre du bruit ou récupère un extrait formellement similaire mais obsolète, la mémoire longue peut vite devenir une longue confusion. Une autre question est de savoir avec quelle prévisibilité le modèle décide d’appeler new_context et quels faits il doit transmettre.

Ce n’est pas une fenêtre de contexte infinie par magie. Codex dispose plutôt d’une façon plus rigoureuse de vivre avec une fenêtre finie, sans prétendre qu’un seul résumé suffit toujours. La question centrale n’est désormais plus de savoir si l’agent sait mémoriser, mais avec quelle précision il comprend ce qui mérite de l’être.

Nous avons déjà expliqué comment les interfaces de cartographie du code améliorent l’injection de contexte et la navigation dans le développement assisté par IA. Ces mêmes enjeux de sélection du contexte sont au cœur du mode expérimental de Codex pour les agents de longue durée.