2 мин чтения

Codex научился искать по истории долгих сессий

Codexуправление контекстомавтономные агенты

В Codex появился экспериментальный compact mode: вместо повторного сжатия диалога в один итог он использует структурированные заметки, поиск по истории и инструмент new_context. Это важно для долгих задач: агент переносит накопленные детали между окнами контекста и может вернуться к прежним требованиям или результатам инструментов.

Codex меняет способ работы с длинным контекстом

Меня здесь цепляет не само слово compact, а смена механики памяти: Codex получил экспериментальный режим со структурированными заметками и поиском по старой истории сессии. В журнале изменений ChatGPT/Codex и справочнике конфигурации OpenAI сказано, что режим сохраняет накопленные детали между окнами контекста и добавляет инструмент new_context. Вместо очередного пересказа всей переписки агент может начать свежее окно и при необходимости найти прежние сообщения или результаты инструментов.

В пользовательском сообщении режим включается командой codex features enable context_management.experimental_mode. Документированный вариант конфигурации задает features.context_management.experimental_mode со значением true. По состоянию на 5 сентября 2026 года функция выключена по умолчанию и доступна только подходящим сессиям ChatGPT Plus, Pro и Pro Lite на бэкенде Codex, но не сессиям с API-ключом или сторонними провайдерами.

Логика выглядит здраво. Заметки держат устойчивые факты, а поиск возвращает подробности, которые в них не попали: старое требование, решение по плану или вывод инструмента. Для автономного кодинга это практичнее цикла сжал, забыл часть, продолжил, особенно когда задача переживает несколько окон контекста.

Один пользователь запустил ночной прогон, чтобы проверить режим на длинном контексте. Другой отдельно отметил, что текст стал заметно читабельнее: исследовательские планы и сложные сводки теперь можно разбирать без дополнительных скиллов. Официальных чисел по качеству experimental mode при этом нет, поэтому пока это сильная конструктивная идея и ранний UX-сигнал, а не доказанный прирост на бенчмарках.

Долгие агентные задачи получают более устойчивую память

Главное изменение простое: агенту больше не обязательно укладывать всю полезную историю в один постоянно переписываемый конспект. Это снижает риск потерять решение, ограничение или результат инструмента только потому, что они не пережили очередное сжатие. Больше всего выиграют длинные рефакторинги, исследовательские задачи и отладочные циклы с меняющимся планом.

Я бы первым делом смотрел на точность поиска и качество самих заметок. Если агент сохраняет шум или вытаскивает формально похожий, но устаревший фрагмент, длинная память быстро превращается в длинную путаницу. Отдельный вопрос: насколько предсказуемо модель решает, когда вызывать new_context и какие факты переносить дальше.

Это не магическое бесконечное контекстное окно. Скорее, Codex получил более инженерный способ жить с конечным окном, не делая вид, что одного резюме всегда достаточно. Теперь главный нерешенный вопрос не в том, умеет ли агент помнить, а в том, насколько точно он понимает, что стоит помнить.

Ранее мы рассказывали, как интерфейсы с картой кода улучшают внедрение контекста и навигацию в AI-разработке. Эти же сложности выбора контекста лежат в основе экспериментального режима Codex для долгих агентных задач.