Claude Opus 5.5 стал самостоятельнее в работе с кодом
Claude Opus 5.5Claude Codeагентное программирование
Что изменилось в Claude Opus 5.5
Я смотрю на Claude Opus 5.5 и вижу не косметический апдейт, а попытку сделать модель устойчивее в длинной автономной работе. Anthropic представила ее 22 сентября 2026 года как модель для продолжительных агентных задач в программировании и работе со знаниями.
В анонсе Anthropic указаны контекст на 1 млн токенов, максимальный вывод в 128 тыс. токенов и адаптивное мышление, включенное по умолчанию. Модель доступна в Claude, Claude Code, Claude Platform и у крупных облачных провайдеров. В примечаниях к Claude Code 2.1.280 она также обозначена как стандартная модель линейки Opus, поэтому релиз сразу появился в CLI-сценариях.
Цена на момент запуска составляла $4 за миллион входных и $20 за миллион выходных токенов. У Opus 5 было $5 и $25 соответственно, а чтение кеша в Claude Code оценивалось в $0,20 за миллион токенов. Для долгоживущего агента эта разница важнее красивой цифры в разовом бенчмарке: стоимость накапливается на каждом цикле чтения, рассуждения и исправления.
Anthropic заявляет более чем на 30% быстрый вывод и примерно на 40% меньшую типичную стоимость работы относительно Opus 5. Опубликованные результаты включают 66,4% в Terminal-Bench 4.0, 54,4% во FrontierCode v1.1 и 57,8% в CursorBench 4.0. Это показатели из материалов запуска, а не замена проверке на собственном репозитории.
Самая любопытная деталь пришла из пользовательского отчета: модель завершила крупную задачу за 3 часа, выдала более читаемый код и медленнее расходовала лимит. Она также самостоятельно добавила условные console.log() для отладки, хотя прямой команды на это не было. Вот это уже похоже не на ускоренный автокомплит, а на выбор следующего инженерного действия.
Почему автономность здесь важнее скорости
Для длинных задач главный сдвиг состоит в меньшей потребности постоянно направлять модель вручную. Если агент сам диагностирует проблему, добавляет наблюдаемость и продолжает работу, сокращается не только время генерации, но и число человеческих вмешательств.
Большой контекст помогает удерживать кодовую базу, историю решений и результаты инструментов в одном процессе. Более экономное расходование лимитов делает такой цикл практичнее, особенно вместе с увеличенными пятичасовыми лимитами для планов Pro, Max и Team, объявленными при запуске.
Но я бы пока не превращал один удачный проектный прогон в универсальный вывод. Автономно добавленный отладочный вывод может быть хорошим решением, а может засорить код или раскрыть лишние данные. Проверять нужно не только финальный результат, но и промежуточные действия агента.
Opus 5.5 выглядит реальным шагом вперед, если заявленная самостоятельность воспроизводится на разных репозиториях. Теперь главный вопрос не в том, умеет ли модель писать код, а в том, насколько долго ей можно не мешать.