Xiaomi MiMo V2.6 Pro UltraSpeed вышла в OpenRouter
Xiaomi MiMoOpenRouterLLM-инференс
Что именно ускорили в MiMo V2.6 Pro
Меня здесь цепляет конкретная цифра: OpenRouter заявляет примерно десятикратное ускорение вывода относительно обычной MiMo V2.6 Pro. На странице модели OpenRouter новинка описана как скоростная редакция того же 1T-чекпойнта с сохранением качества исходной Pro-версии.
MiMo V2.6 Pro UltraSpeed появилась на платформе 21 сентября 2026 года. Указанное контекстное окно составляет 1 048 576 токенов, поэтому ускорение не оплачено очевидным урезанием доступного контекста. Для длинных агентных сессий и работы с крупными репозиториями это сочетание выглядит интереснее, чем просто высокий показатель токенов в секунду.
На момент релиза вход стоил $4,35 за миллион токенов, выход стоил $8,70. В карточке провайдера Xiaomi платформа также показывала пропускную способность 169 токенов в секунду и задержку 1,29 секунды. Это уже достаточно конкретные ориентиры, хотя переносить их напрямую на любую рабочую нагрузку я бы не стал.
Первым делом я бы проверял не красивый пик, а устойчивую скорость на длинной генерации, время до первого токена и поведение при заполненном контексте. Метрика OpenRouter отражает наблюдаемую работу конкретной записи провайдера, а не гарантированный результат для каждого запроса. Очереди, длина промпта и характер декодирования легко меняют картину.
Отдельный плюс OpenRouter здесь чисто практический: модель доступна через привычный совместимый API под идентификатором xiaomi/mimo-v2.6-pro-ultraspeed. Менять весь клиентский стек ради проверки новой модели не требуется.
Где такая скорость действительно меняет расклад
Главный выигрыш получают интерактивные системы, где пользователь или агент ждёт продолжения прямо сейчас. Быстрый вывод сокращает паузы в циклах планирования, генерации кода и последовательных вызовах инструментов, а большое контекстное окно позволяет дольше удерживать рабочее состояние.
Но UltraSpeed не становится автоматическим выбором для пакетной обработки. При больших объёмах выходных токенов важны не только 169 токенов в секунду, но и итоговая стоимость, стабильность провайдера и качество именно на целевых задачах. Заявление о совпадении качества с Pro-версией я воспринимаю как гипотезу для сравнительной оценки, а не как универсальную гарантию.
Это не просто косметический суффикс Fast: сочетание заявленного ускорения, длинного контекста и прозрачной цены делает модель реальной альтернативой для низколатентного инференса. Главный нерешённый вопрос теперь в том, насколько хорошо эти цифры переживут длинные запросы и реальную конкуренцию за вычисления.