2 хв читання

Claude веде 26% AI R&D усередині Anthropic

AnthropicClaudeAI R&D

У серпні 2026 року Anthropic повідомила, що Claude вів 26% вимірюваної внутрішньої AI R&D. Повністю автономних ділянок роботи не було, проте понад 90% спостережуваних завдань виконувалися за участю AI. Це важливо, бо показник описує реальний дослідницький процес, а не окреме демо.

Що саме виміряла Anthropic

Для мене головний висновок серпневого зрізу 2026 року простий: Claude «вів» 26% вимірюваної AI R&D усередині Anthropic. У звіті Anthropic Institute «Measuring the pace of AI development» це не прирівнюється до повної автономності. Жоден виміряний фрагмент роботи не потрапив до повністю автономного режиму.

Ключове слово тут саме «вів». Для R&D Automation Index компанія застосовує драбину автоматизації на основі шестирівневої шкали Epoch AI, де лідерство AI означає високий ступінь участі, але не самостійне виконання всього дослідницького циклу. Це точніше й корисніше, ніж бінарний поділ на ручну та автономну роботу.

Другий важливий показник: понад 90% вимірюваної роботи виконувалося щонайменше в режимі співпраці людини з AI. Інакше кажучи, AI уже вбудований майже в увесь спостережуваний процес. Водночас це не означає, що Claude незалежно ставить завдання, перевіряє гіпотези та ухвалює остаточні рішення.

Методика охоплює три напрями: частку AI-led R&D, нагляд за діями агентів і розподіл обчислень між розвитком можливостей та безпекою. Нагляд оцінюють практично: чи можна відстежити, заблокувати або передати людині дію агента до її виконання. У тому самому серпневому зрізі близько 6% обчислень для AI R&D припадало на безпеку та пов'язану роботу.

Чому ці цифри змінюють розмову про автономність

Це реальний зсув, але не народження автономного AI-дослідника. Поєднання 26% AI-led роботи та відсутності повністю автономних ділянок показує цікавішу картину: агенти вже можуть вести помітні частини процесу, тоді як людина зберігає контроль над рамкою та критичними рішеннями.

Для інженерних команд найважливіша сама градація участі. Метрика відокремлює підказки й співпрацю від режиму, де AI фактично керує роботою. Без такого розмежування будь-яка заява про «автоматизацію досліджень» перетворюється на гарне, але технічно порожнє формулювання.

Показник у 6% також не варто читати як доказ достатньої безпеки. Це зріз розподілу compute на момент звіту, а не оцінка якості результатів. Я б стежив, чи зростає ця частка разом з автономністю та наскільки зіставно різні лабораторії класифікують safety-роботу.

Найважливіший наступний крок тут не новий рекорд Claude, а відтворюваний часовий ряд. Одна точка показує масштаб упровадження, але лише динаміка покаже, чи рухається AI від співпраці до самостійного керування дослідженнями швидше, ніж розвивається нагляд.

Раніше ми розбирали, як Claude справляється з розробкою C-компілятора та де його можливості все ще обмежені. Цей кейс допомагає предметно інтерпретувати заявлені Anthropic 26% R&D-роботи.