Codex научился искать по истории долгих сессий
Codexуправление контекстомавтономные агенты
Codex меняет способ работы с длинным контекстом
Меня здесь цепляет не само слово compact, а смена механики памяти: Codex получил экспериментальный режим со структурированными заметками и поиском по старой истории сессии. В журнале изменений ChatGPT/Codex и справочнике конфигурации OpenAI сказано, что режим сохраняет накопленные детали между окнами контекста и добавляет инструмент new_context. Вместо очередного пересказа всей переписки агент может начать свежее окно и при необходимости найти прежние сообщения или результаты инструментов.
В пользовательском сообщении режим включается командой codex features enable context_management.experimental_mode. Документированный вариант конфигурации задает features.context_management.experimental_mode со значением true. По состоянию на 5 сентября 2026 года функция выключена по умолчанию и доступна только подходящим сессиям ChatGPT Plus, Pro и Pro Lite на бэкенде Codex, но не сессиям с API-ключом или сторонними провайдерами.
Логика выглядит здраво. Заметки держат устойчивые факты, а поиск возвращает подробности, которые в них не попали: старое требование, решение по плану или вывод инструмента. Для автономного кодинга это практичнее цикла сжал, забыл часть, продолжил, особенно когда задача переживает несколько окон контекста.
Один пользователь запустил ночной прогон, чтобы проверить режим на длинном контексте. Другой отдельно отметил, что текст стал заметно читабельнее: исследовательские планы и сложные сводки теперь можно разбирать без дополнительных скиллов. Официальных чисел по качеству experimental mode при этом нет, поэтому пока это сильная конструктивная идея и ранний UX-сигнал, а не доказанный прирост на бенчмарках.
Долгие агентные задачи получают более устойчивую память
Главное изменение простое: агенту больше не обязательно укладывать всю полезную историю в один постоянно переписываемый конспект. Это снижает риск потерять решение, ограничение или результат инструмента только потому, что они не пережили очередное сжатие. Больше всего выиграют длинные рефакторинги, исследовательские задачи и отладочные циклы с меняющимся планом.
Я бы первым делом смотрел на точность поиска и качество самих заметок. Если агент сохраняет шум или вытаскивает формально похожий, но устаревший фрагмент, длинная память быстро превращается в длинную путаницу. Отдельный вопрос: насколько предсказуемо модель решает, когда вызывать new_context и какие факты переносить дальше.
Это не магическое бесконечное контекстное окно. Скорее, Codex получил более инженерный способ жить с конечным окном, не делая вид, что одного резюме всегда достаточно. Теперь главный нерешенный вопрос не в том, умеет ли агент помнить, а в том, насколько точно он понимает, что стоит помнить.