2 хв читання

LTX-2.5 і H3: два різні шляхи до швидкого відео

LTX-2.5H3генерация видео

У серпні 2026 року з’явилися два різні сигнали прискорення генерації відео: офіційний реліз LTX-2.5 та оновлений H3 від MiniMax. Для LTX є конкретний орієнтир: 10-секундний ролик за 6,8 секунди на двох NVIDIA GB200. H3 має сильну архітектуру, але зіставного показника швидкості поки немає.

Це LTX-2.5 чи окрема швидка модель?

Я б не змішував ці новини: доступні дані вказують на офіційне оновлення LTX та окремий розвиток H3, а не на одну загадкову нову модель. Команда LTX в офіційній картці LTX-2.5 називає реліз від 11 серпня 2026 року найбільшим оновленням лінійки.

LTX-2.5 отримала нативну генерацію сцен із кількох планів, редагування наявного відео та diffusion-декодер для підвищення деталізації. Також заявлено синхронний звук, генерації тривалістю до 20 секунд, роздільності 1080p, 1440p і нативне 4K. Частота кадрів залежить від режиму й включає 24, 25, 48 та 50 FPS.

Найпоказовіша цифра швидкості надійшла з публічного огляду продуктивності: десятисекундний ролик генерувався локально за 6,8 секунди на двох NVIDIA GB200. Через LTX API аналогічний показник становив 23,7 секунди. Це не просто прискорення моделі: різниця добре демонструє ціну мережевого рівня, черги та серверної конфігурації.

З H3 картина інша. У описі релізу MiniMax H3 представлено як відкриту омнімодальну модель із 33,1 млрд параметрів, єдиним потоком обробки та нативним стереозвуком. Базове полотно має 768 пікселів за короткою стороною, а окремий шлях H3-Regenerate-2K підвищує роздільність до 2K; підтримуються ролики від 4 до 15 секунд.

Тому версія про те, що H3 оновили й прискорили, технічно видається правдоподібною, але в доступних матеріалах немає підтвердженого зіставного показника швидкості. Сильні позиції H3 у відкритих рейтингах говорять про якість, а не автоматично про меншу затримку.

Що справді змінюється для відеопайплайнів

LTX-2.5 уже переводить розмову про прискорення з площини тизерів у вимірювані секунди. Генерація ролика швидше за його тривалість можлива на потужній локальній конфігурації, але результат API помітно повільніший. Для інтерактивних інструментів саме ця різниця може визначити весь користувацький досвід.

У H3 інший козир: відкриті ваги та єдина робота з відео й звуком роблять модель цікавою для локальних пайплайнів і ComfyUI. Втім, 33,1 млрд параметрів означають, що реальна доступність залежатиме від пам’яті, квантування та якості оптимізованих збірок, а не лише від архітектури на папері.

Я б насамперед порівнював не красивий ролик із публікації, а однакові промпти, роздільність, тривалість, звук і апаратну конфігурацію. Наразі LTX дає ясніший сигнал щодо швидкості, а H3 виглядає сильною відкритою основою. Головна інтрига тепер не в тому, хто показав найшвидше демо, а хто збереже якість після чесного вирівнювання умов.

Раніше ми розбирали Seedance 2.0 у ChatCut, зокрема покращення динаміки та фізики контактів у генерації відео. Цей досвід допомагає зіставити технічний прогрес LTX 2.5 і H3 із практичними обмеженнями відеовиробництва.