2 хв читання

GPT-6 Astra: мультимодальність і ризик для агентів

GPT-6 AstraOpenAIбезопасность ИИ

OpenAI випустила GPT-6 Astra й поступово відкриває її у ChatGPT, API та AWS. Мультимодальність і computer use розширюють агентні сценарії, але підвищують ризик prompt injection: прихований текст може змінити мету агента без запуску шкідливого коду.

Що саме отримала GPT-6 Astra

У цьому релізі привертає увагу не ярлик «найпотужніша», а широкий запуск GPT-6 Astra одночасно в ChatGPT Plus, Pro, Business, Enterprise, API та AWS. В офіційній документації й матеріалах запуску OpenAI модель названо найздібнішою у лінійці, а окремий запис gpt-6-astra на сторінці цін підтверджує доступ через платформу OpenAI.

На момент анонсу розгортання відбувається поетапно. Для Enterprise доступ контролюють адміністратори, а за замовчуванням він вимкнений. Це розумна пауза: модель орієнтована не лише на відповіді в чаті, а й на computer use, агентну поведінку та мультимодальні завдання.

Обговорюваний режим Jarvis поки варто відокремлювати від підтверджених можливостей. У доступних офіційних матеріалах OpenAI такої назви немає. Computer use підтверджено, але конкретний режим із цією назвою поки є предметом обговорення, а не специфікацією продукту.

Порівняння з Fable 5.1 також не дає однозначного переможця. За незалежними оцінками Astra поступається їй у програмуванні та дизайні, зате виглядає сильнішою в математиці, 3D, комп’ютерному зорі та науці. Водночас сторонні зведення приписують Fable 5.1 результат 55,8% на Terminal-Bench 4.0, 73,4% на CursorBench 3.2.0 і 100% на ProofBench v1.1.

Я б не зводив ці цифри до єдиного рейтингу. Їх отримано на різних завданнях і переказано сторонніми джерелами, а не зіставлено в спільній картці моделей. Для агентної системи особливо важливо, чи вимірює тест лише успішність виконання завдання, чи також стійкість до шкідливих інструкцій.

Чому безпека важливіша за рейтинг

Головний інженерний ризик Astra полягає в тому, що здібніший агент отримує більше способів помилитися з реальними наслідками. В огляді безпеки OpenAI модель названо першою, що досягла рівня Critical за кіберможливостями в межах Preparedness Framework, тому доступ для захисного тестування вводять поступово.

Prompt injection не потребує запуску шкідливого коду. Прихована інструкція в документі або на сторінці може змусити агента змінити мету, розкрити доступний контекст чи неправильно використати інструмент. Для користувача це може виглядати як зараження агента, хоча насправді модель просто сприйняла чужий текст як пріоритетнішу команду.

У продакшені я б насамперед перевіряв ізоляцію інструментів, межі повноважень і обробку недовіреного контенту. Бенчмарк із математики чи програмування цього не покаже. Справжня планка для GPT-6 Astra визначається не тим, наскільки далеко агент здатен пройти сам, а тим, наскільки надійно він уміє зупинитися перед чужою інструкцією.

Ми вже розглядали, як поява Codex у ChatGPT для Android змінює сценарії віддаленої розробки та автоматизації. Запуск GPT-6 Astra продовжує цей напрям, розширюючи можливості асистента завдяки новому режиму та мультимодальності.