Codex sait désormais chercher dans l’historique des longues sessions
Codexуправление контекстомавтономные агенты
Codex change sa manière de gérer les contextes longs
Ce qui retient l’attention n’est pas le mot compact lui-même, mais l’évolution du mécanisme de mémoire : Codex a reçu un mode expérimental avec des notes structurées et une recherche dans l’ancien historique de session. Le journal des modifications de ChatGPT/Codex et la référence de configuration d’OpenAI indiquent que ce mode conserve les détails accumulés entre les fenêtres de contexte et ajoute l’outil new_context. Au lieu de produire un nouveau résumé de toute la conversation, l’agent peut ouvrir une nouvelle fenêtre et retrouver, si nécessaire, les messages précédents ou les résultats d’outils.
Dans un message utilisateur, le mode s’active avec la commande codex features enable context_management.experimental_mode. L’option de configuration documentée définit features.context_management.experimental_mode sur true. Au 5 septembre 2026, la fonction est désactivée par défaut et réservée aux sessions éligibles ChatGPT Plus, Pro et Pro Lite sur le backend Codex, et non aux sessions avec clé API ou fournisseurs tiers.
La logique est saine. Les notes conservent les faits stables, tandis que la recherche ramène les détails qui n’y figurent pas : une ancienne exigence, une décision de planification ou une conclusion d’outil. Pour le codage autonome, c’est plus pratique que le cycle consistant à compresser, oublier une partie, puis continuer, surtout lorsqu’une tâche traverse plusieurs fenêtres de contexte.
Un utilisateur a lancé une exécution nocturne afin de tester le mode sur un contexte long. Un autre a signalé séparément que le texte était devenu nettement plus lisible : les plans de recherche et les synthèses complexes peuvent désormais être examinés sans compétences supplémentaires. Il n’existe toutefois pas encore de chiffres officiels sur la qualité de l’experimental mode ; il s’agit donc pour l’instant d’une idée de conception solide et d’un premier signal UX, pas d’un gain prouvé par les benchmarks.
Les longues tâches agentiques gagnent une mémoire plus robuste
Le changement principal est simple : l’agent n’est plus obligé de faire tenir tout l’historique utile dans un unique résumé sans cesse réécrit. Cela réduit le risque de perdre une décision, une contrainte ou un résultat d’outil simplement parce qu’ils n’ont pas survécu à la compression suivante. Les longs refactorings, les tâches de recherche et les cycles de débogage aux plans mouvants devraient en profiter le plus.
Je regarderais d’abord la précision de la recherche et la qualité des notes elles-mêmes. Si l’agent enregistre du bruit ou récupère un extrait formellement similaire mais obsolète, la mémoire longue peut vite devenir une longue confusion. Une autre question est de savoir avec quelle prévisibilité le modèle décide d’appeler new_context et quels faits il doit transmettre.
Ce n’est pas une fenêtre de contexte infinie par magie. Codex dispose plutôt d’une façon plus rigoureuse de vivre avec une fenêtre finie, sans prétendre qu’un seul résumé suffit toujours. La question centrale n’est désormais plus de savoir si l’agent sait mémoriser, mais avec quelle précision il comprend ce qui mérite de l’être.