Почему подписки не хватает для постоянного ИИ-агента
ИИ-агентыкодовые агентылимиты подписок
Подписка закончилась раньше, чем агент завершил работу
Я здесь сразу вижу главную проблему: месячная цена почти ничего не говорит о доступном объёме агентной работы. В приведённой ветке пользовательского обсуждения подписка ChatGPT за $20 упёрлась в пятичасовой лимит за полчаса, причём аналогичная задача через Antigravity, по его словам, заняла пять минут и почти не затронула лимиты.
Это единственный первичный источник для описанного случая, поэтому воспринимать цифры нужно именно как пользовательский опыт, а не официальный бенчмарк. В ветке нет промптов, размера репозитория, числа вызовов инструментов и настроек модели. Без этих данных сравнение скорости остаётся показательным, но невоспроизводимым.
Другой участник пишет, что подписки за $100 ему хватало для полноценной работы с Sol 5.6, тогда как Astra расходует недельный лимит за день. Ещё несколько оценок звучат жёстче: для активной генерации якобы нужны две подписки по $200, а без сбросов лимитов обсуждается уже три таких подписки.
Отдельно упомянут корпоративный доступ Anthropic: средний расход на Opus пользователь оценивает в $2–3 тысячи, без Fable. Это не опубликованный тариф и не подтверждённый счёт, а частная оценка из той же ветки. На 11 сентября 2026 года считать эти суммы актуальным прайс-листом нельзя: дата самого обсуждения и официальные таблицы лимитов во входных данных отсутствуют.
Технически разброс вполне объясним. Агент расходует бюджет не одной генерацией ответа, а повторным чтением контекста, планированием, вызовами инструментов, проверкой результата и исправлениями. Высокий effort и fast-режим могут резко изменить пропускную способность даже внутри одной подписки.
Считать нужно не подписки, а завершённые задачи
Практический вывод простой: для автономного кодового агента важнее стоимость завершённой задачи и время до ограничения, чем цена тарифа. Дешёвая подписка проигрывает, если агент полчаса крутит цикл, после чего останавливается до сброса лимита.
Я бы первым делом измерял число агентных шагов, объём повторно передаваемого контекста, долю полезных изменений и время ожидания. Затем отдельно проверял бы поведение на длинных сессиях: именно там накапливаются дорогие перечитывания, неудачные ветки и повторные вызовы инструментов.
Эта ветка не доказывает, что одна модель безусловно экономичнее другой. Зато она хорошо показывает разрыв между интерактивным помощником и постоянно работающим агентом: без прозрачного бюджета на вычисления слово «подписка» маскирует главный параметр системы, сколько полезной автономной работы она действительно выдерживает.