Claude Opus 5.5 став самостійнішим у роботі з кодом
Claude Opus 5.5Claude Codeагентное программирование
Що змінилося в Claude Opus 5.5
Дивлячись на Claude Opus 5.5, я бачу не косметичне оновлення, а спробу зробити модель стійкішою в тривалій автономній роботі. Anthropic представила її 22 вересня 2026 року як модель для довгих агентних завдань у програмуванні та роботі зі знаннями.
В анонсі Anthropic вказано контекст на 1 млн токенів, максимальний вивід у 128 тис. токенів і адаптивне мислення, увімкнене за замовчуванням. Модель доступна в Claude, Claude Code, Claude Platform і в основних хмарних провайдерів. У примітках до Claude Code 2.1.280 її також позначено як стандартну модель лінійки Opus, тому реліз одразу з'явився в CLI-сценаріях.
На момент запуску ціна становила $4 за мільйон вхідних і $20 за мільйон вихідних токенів. Для Opus 5 це було $5 і $25 відповідно, а читання кешу в Claude Code оцінювалося в $0,20 за мільйон токенів. Для довготривалого агента ця різниця важливіша за красивий результат разового бенчмарку: вартість накопичується в кожному циклі читання, міркування та виправлення.
Anthropic заявляє про більш ніж на 30% швидший вивід і приблизно на 40% нижчу типову вартість задачі порівняно з Opus 5. Опубліковані результати містять 66,4% у Terminal-Bench 4.0, 54,4% у FrontierCode v1.1 та 57,8% у CursorBench 4.0. Це показники з матеріалів запуску, а не заміна перевірки на власному репозиторії.
Найцікавіша деталь надійшла з користувацького звіту: модель завершила велику задачу за три години, видала читабельніший код і повільніше витрачала ліміт. Вона також самостійно додала умовні console.log() для налагодження, хоча прямої вказівки на це не було. Це вже схоже не на прискорене автодоповнення, а на вибір наступної інженерної дії.
Чому автономність тут важливіша за швидкість
Для довгих задач головний зсув полягає в меншій потребі постійно спрямовувати модель вручну. Якщо агент сам діагностує проблему, додає спостережуваність і продовжує роботу, скорочується не лише час генерації, а й кількість людських втручань.
Великий контекст допомагає утримувати кодову базу, історію рішень і результати інструментів в одному процесі. Економніше використання лімітів робить такий цикл практичнішим, особливо разом зі збільшеними п'ятигодинними лімітами для планів Pro, Max і Team, оголошеними під час запуску.
Однак я б поки не перетворював один вдалий прогін проєкту на універсальний висновок. Автоматично доданий налагоджувальний вивід може бути хорошим рішенням, але може й засмітити код або розкрити зайві дані. Перевіряти потрібно не тільки фінальний результат, а й проміжні дії агента.
Opus 5.5 виглядає реальним кроком уперед, якщо заявлена самостійність відтворюється на різних репозиторіях. Тепер головне питання не в тому, чи вміє модель писати код, а в тому, як довго їй можна не заважати.