Splash отсекает M1 Max и Ultra: что запускать вместо
SplashApple Siliconлокальный ИИllama.cppMetal
Почему даже мощные M1 Max и Ultra остались за бортом
Сразу неприятный вывод: большой объём памяти не спасает M1 Max или M1 Ultra от ограничения Splash. Текущая выпущенная сборка требует Apple M3 или новее, macOS 26.4 и минимум 36 ГБ объединённой памяти. Inco в описании требований рекомендует уже 48 ГБ.
Ключевой барьер здесь аппаратный, а не только количественный. По сообщениям сообщества, на старых Mac движок останавливается с ошибкой семейства GPU. Нужное GPU family 9 начинается с M3, поэтому машина с большим объёмом памяти всё равно не проходит проверку совместимости.
И вот тут стало интересно: Splash устроен не как универсальный рантайм для произвольных моделей. Это специализированный движок с Metal-ядрами и заранее подготовленными раскладками моделей, оптимизированными под конкретные цели. Такой подход позволяет выжимать скорость из поддерживаемого железа, но делает совместимость частью самой архитектуры, а не пунктом, который легко отключить.
Для моделей класса 27B одновременно важны ёмкость объединённой памяти, её пропускная способность и доступные возможности GPU. Поэтому ограничение на M3 выглядит не декоративным фильтром, а следствием выбранной схемы оптимизации. Текущая официальная совместимость не позволяет просто перенести Splash-пакет на M1 или M2.
Что остаётся владельцам старых Apple Silicon
Практичный путь для M1 и M2 сейчас один: использовать более универсальный движок и отдельно подбирать модель под доступную память. LM Studio с llama.cpp и Metal поддерживает поколения M1, M2, M3 и M4, а прямой запуск llama.cpp даёт тот же базовый маршрут без оболочки.
Компромисс понятен. Вместо оптимизаций Splash придётся выбирать GGUF-модель меньшего размера либо более агрессивное квантование. Скорость и качество будут зависеть уже не от красивого названия чипа, а от конкретной модели, формата и того, сколько слоёв реально помещается в объединённую память.
Я бы первым делом проверял не паспортный объём RAM, а поддержку GPU-семейства выбранным рантаймом. История со Splash хорошо показывает новую границу локального ИИ: старый Mac может быть достаточно мощным вычислительно, но оказаться слишком старым для конкретного набора Metal-ядер.
Это не конец M1 Max и Ultra для локальных моделей. Это конец иллюзии, что большой объём объединённой памяти автоматически гарантирует совместимость с каждым новым специализированным движком.