3 мин чтения

Codex: Chat-to-Work и дорогой Fast Mode

CodexChatGPT WorkFast Mode

Chat-to-Work позволяет продолжить обычный диалог в режиме Work с файлами, контекстом проекта и задачами. ChatGPT Work и Codex используют общий пул, а Fast Mode обменивает квоту на скорость: документация говорит об ускорении примерно в 1,5 раза при расходе кредитов в 2 или 2,5 раза выше, в зависимости от модели.

Что именно поменялось в Codex

Для меня главный сдвиг здесь не Fast Mode, а переход из обычного чата в Work без потери хода разговора. Официальная документация ChatGPT Work и Codex описывает верхний переключатель Chat или Work, а также запуск нового чата или открытие существующего проекта. По сути, это и есть chat-to-work: обсуждение превращается в задачу с рабочим контекстом.

В Work можно использовать контекст проекта, открывать локальные папки и продолжать уточнения в том же чате. Это небольшое изменение интерфейса, но архитектурно оно убирает неприятный разрыв между этапом, когда формулируется замысел, и этапом, когда агент уже работает с файлами и ограничениями. Меньше ручного переноса контекста, меньше шансов потерять важную оговорку.

На момент публикации, 23 августа 2026 года, ChatGPT Work и Codex используют общий пул лимитов, цен и кредитов. Fast Mode дает примерно 1,5-кратное ускорение, но списывает больше кредитов: для GPT-5.4 в актуальной сводке документации фигурирует множитель 2×, для GPT-5.5 и GPT-5.6 множитель 2,5×. Документация также указывает команды /fast on, /fast off и /fast status; настройка доступна через config.toml.

Комьюнити-сигнал хорошо показывает субъективную сторону этой математики. Один пользователь сообщил, что за день потратил 15% квоты пакета 20x в Fast, а затем около 10% за два дня в обычном режиме; отдельно прозвучало сообщение о reset квот. Это не контролируемый тест и не официальный замер, поэтому я воспринимаю его только как предупреждение о заметности расхода.

Ускорение упирается в экономику квоты

Fast Mode имеет смысл только там, где задержка ответа действительно блокирует работу. При заявленном ускорении примерно в 1,5 раза и расходе в 2 или 2,5 раза скорость растет слабее квоты. Для длинных агентных задач это может оказаться дорогим обменом, особенно если время уходит не на генерацию, а на инструменты, файлы и проверки.

Я бы первым делом смотрел на две метрики: расход квоты на завершенную задачу и полное время до пригодного результата. Если Fast лишь быстрее показывает промежуточные шаги, но не сокращает весь цикл, удвоенное или большее списание трудно оправдать. Модель тоже нельзя игнорировать: множитель зависит от нее.

Chat-to-Work выглядит более фундаментальным улучшением. Он сохраняет контекст между разговором и исполнением, тогда как Fast Mode в основном покупает меньшую задержку за общий лимит. И вот тут расклад простой: удобный переход останется полезным, а ценность Fast будет каждый раз заново доказываться на реальных задачах.

Ранее мы рассказывали о предварительном запуске Codex в ChatGPT для Android и о том, что он меняет для распределённых команд разработки. Этот запуск помогает понять, как работа с Codex через чат развивается во всём продукте.