2 хв читання

Codex почав швидше витрачати usage?

CodexAI-агентылимиты подписки

Користувачі Codex повідомляють, що за останні два дні usage почав витрачатися у два-три рази швидше; на сайт із кількох сторінок в одного учасника пішло 12% квоти. Це не доводить зміну лімітів, але показує вартість автономних циклів агента.

Що саме помітили користувачі

Я б поки не називав це тихим скороченням лімітів Codex: в наявних даних немає офіційного підтвердження. Водночас сигнал від користувачів досить конкретний: usage нібито почав витрачатися у два-три рази швидше, а зміну помітили протягом останніх двох днів.

Первинним джерелом тут є не картка моделі й не changelog, а обговорення користувачів Codex, доступне станом на 21 вересня 2026 року. Один учасник описав прискорену витрату, інший жартома пов'язав її з переходом із підписки за 20 на підписку за 100, а третій повідомив, що на сайт із кількох сторінок пішло 12%.

Ці спостереження не можна вважати доказом зміни квот. Невідомі обрана модель, довжина контексту, кількість запитів, обсяг файлів і число дій агента. Навіть формулювання про 12% не уточнює, який саме ліміт показував інтерфейс.

Проте загальна механіка виглядає правдоподібною. Автономний coding agent витрачає ресурс не лише на фінальну відповідь: він читає кілька файлів, викликає інструменти, редагує код, запускає збірку або тести й повторює цикл після помилки. Невеликий фінальний результат зовсім не означає малого обсягу обчислень.

Подібний тиск на квоти видно і поза Codex. Anthropic в оновленні лімітів Claude Code повідомляла про подвоєння п'ятигодинних лімітів і скасування обмежень у години пік для платних планів. Це не пояснює конкретний випадок Codex, але підтверджує, що агентне програмування регулярно впирається в межі підписки.

Квота стає частиною архітектури роботи

Для бюджетування висновок простий: рахувати лише кількість завдань уже недостатньо. Один багатофайловий цикл із повторними компіляціями, тестами та виправленнями може виявитися важчим за десятки коротких запитів, хоча користувач бачить лише одне поставлене завдання.

Насамперед я б порівнював не враження, а режим моделі, довжину промпту, обсяг підключеного контексту та кількість інструментальних циклів. Якщо витрата справді зросла за однакового сценарію, тоді версія про зміну обліку або лімітів стане сильнішою. Поки що даних для такого висновку замало.

Головний зсув уже відбувся: usage перестав бути фоновою цифрою в інтерфейсі. Для автономних AI-агентів це такий самий обмежений ресурс, як час збірки чи обчислювальний бюджет, лише його реальна вартість часто стає помітною вже після запуску циклу.

Раніше ми розглядали, як ліміти контексту Claude, extended thinking і конфігурації моделей перетворюються на вищі витрати usage. Цей аналіз допомагає пояснити, чому асистенти для програмування можуть витрачати токени швидше, ніж очікують команди.