GPT-6.1 Sol: Ultrafast змінює економіку Codex
GPT-6.1 SolCodexUltrafast
Що OpenAI додала до GPT-6.1 Sol і Codex
Я б не зводив цей реліз до чергового прискорення моделі. У матеріалах DevDay 2026 та довідці ChatGPT Learn OpenAI описує відразу кілька пов'язаних змін: GPT-6.1 Sol, рівні швидкості Fast і Ultrafast, Decisions API та Codex harness з відкритим вихідним кодом.
Головна цифра Ultrafast — до 300 токенів за секунду і до восьмикратного прискорення генерації в Codex. Для API заявлено прискорення до шести разів. Але це саме пропускна здатність генерації, а не обіцянка завершувати все завдання у стільки ж разів швидше.
Ціна теж не схожа на демпінг. На момент анонсу Ultrafast коштував у шість разів дорожче за стандартний API-тариф. Тому поширене в обговореннях твердження про зниження ціни на 95% не підтверджується офіційними матеріалами OpenAI.
Щодо доступності є важливе застереження. GPT-6.1 Sol заявлено для користувачів Plus, Pro, Business, Enterprise та Edu у ChatGPT Work і Codex, однак підтримка Ultrafast для Sol має з'явитися пізніше. Сам рівень Ultrafast на старті призначався для Pro за 500 доларів і відповідних робочих просторів Enterprise та Edu, з урахуванням дозволів адміністратора.
Decisions API виконує вужче завдання: отримує запитання, обмежений набір варіантів і контекст, а потім обирає відповідь. Це інтерфейс для маршрутизації, класифікації та вибору наступного кроку без зайвої вільної генерації. Відкритий Codex harness, своєю чергою, дає змогу вивчати й змінювати шар, що пов'язує модель із робочими процесами та інтеграціями.
Чому швидкість ще не означає дешевшу розробку
Ultrafast справді змінює баланс там, де затримка важливіша за ціну. Інтерактивна робота з кодом, короткі цикли виправлень і паралельні агентні завдання можуть виграти від швидшої видачі токенів, навіть якщо кожен запит коштує дорожче.
Насамперед я б порівнював не токени за секунду, а повний час виконання завдання. Планування, виклики інструментів, тести й повторні спроби нікуди не зникають. Якщо генерація займає лише частину циклу, заявлене восьмикратне прискорення легко перетворюється на значно скромніший підсумковий виграш.
Decisions API виглядає менш ефектно, але інженерно може виявитися практичнішим. Обмежений набір відповідей простіше перевіряти та вбудовувати у детермінований конвеєр. Тут менше магії, зате зрозуміліший контракт і помітніші точки відмови.
Стратегія OpenAI читається чітко: поділити одну модель за класами затримки й брати премію за терміновість. Справжній тест Ultrafast почнеться там, де швидкість генерації зіткнеться з повільними інструментами, довгими агентними циклами та реальною вартістю завершеного завдання.