Codex kann jetzt den Verlauf langer Sitzungen durchsuchen
Codexуправление контекстомавтономные агенты
Codex verändert den Umgang mit langem Kontext
Interessant ist hier nicht das Wort compact selbst, sondern der Wechsel im Speichermechanismus: Codex hat einen experimentellen Modus mit strukturierten Notizen und einer Suche im älteren Sitzungsverlauf erhalten. Im Changelog von ChatGPT/Codex und in der OpenAI-Konfigurationsreferenz steht, dass der Modus gesammelte Details zwischen Kontextfenstern bewahrt und das Tool new_context ergänzt. Statt die gesamte Unterhaltung erneut zusammenzufassen, kann der Agent ein neues Fenster beginnen und bei Bedarf frühere Nachrichten oder Tool-Ergebnisse finden.
In einer Nutzernachricht wird der Modus mit dem Befehl codex features enable context_management.experimental_mode aktiviert. Die dokumentierte Konfigurationsvariante setzt features.context_management.experimental_mode auf true. Stand 5. September 2026 ist die Funktion standardmäßig deaktiviert und nur für geeignete ChatGPT-Plus-, Pro- und Pro-Lite-Sitzungen auf dem Codex-Backend verfügbar, nicht jedoch für Sitzungen mit API-Schlüssel oder Drittanbieter.
Die Logik wirkt sinnvoll. Notizen halten stabile Fakten fest, während die Suche Details zurückbringt, die darin nicht gelandet sind: eine frühere Anforderung, eine Planungsentscheidung oder eine Tool-Schlussfolgerung. Für autonomes Programmieren ist das praktischer als der Zyklus aus komprimieren, einen Teil vergessen und weitermachen, insbesondere wenn eine Aufgabe mehrere Kontextfenster überdauert.
Ein Nutzer startete einen nächtlichen Lauf, um den Modus mit langem Kontext zu testen. Ein anderer merkte gesondert an, dass der Text deutlich lesbarer geworden sei: Forschungspläne und komplexe Zusammenfassungen lassen sich nun ohne zusätzliche Skills auswerten. Offizielle Qualitätszahlen zum experimental mode gibt es allerdings noch nicht. Daher ist dies vorerst eine starke Konstruktionsidee und ein frühes UX-Signal, kein auf Benchmarks belegter Gewinn.
Lange Agentenaufgaben erhalten ein robusteres Gedächtnis
Die wichtigste Änderung ist einfach: Der Agent muss nicht mehr die gesamte nützliche Historie in eine einzige, ständig umgeschriebene Zusammenfassung pressen. Das senkt das Risiko, eine Entscheidung, Einschränkung oder ein Tool-Ergebnis zu verlieren, nur weil diese Information die nächste Komprimierung nicht überlebt hat. Lange Refactorings, Rechercheaufgaben und Debugging-Zyklen mit wechselndem Plan dürften am meisten profitieren.
Ich würde zuerst auf die Genauigkeit der Suche und die Qualität der Notizen selbst achten. Wenn der Agent Rauschen speichert oder einen formal ähnlichen, aber veralteten Ausschnitt abruft, wird langes Gedächtnis schnell zu langer Verwirrung. Eine weitere Frage ist, wie vorhersehbar das Modell entscheidet, wann es new_context aufrufen und welche Fakten es weitertragen soll.
Das ist kein magisches unendliches Kontextfenster. Codex hat vielmehr eine technisch solidere Möglichkeit erhalten, mit einem endlichen Fenster zu arbeiten, ohne so zu tun, als reiche eine einzige Zusammenfassung immer aus. Die zentrale offene Frage ist nicht mehr, ob der Agent sich erinnern kann, sondern wie genau er versteht, woran er sich erinnern sollte.