2 мин чтения

Holo4: открытые модели для компьютерных агентов

Holo4компьютерные агентыоткрытые модели

H Company выпустила Holo4 — семейство моделей с открытыми весами для управления вебом, рабочим столом и мобильными интерфейсами. В линейке есть плотная 27B-модель и разреженная 35B-A3B. Релиз важен квантованными форматами, локальным развёртыванием и возможностью самостоятельно проверять агентов на реальных интерфейсах.

Что именно выпустила H Company

Меня здесь цепляет не размер моделей, а практичность релиза: Holo4 рассчитан на управление вебом, рабочим столом и мобильными интерфейсами. В анонсе H Company от 28 сентября 2026 года это семейство представлено как generalist computer-use models с открытыми весами.

В линейке две разные архитектуры. Holo4-27B представляет собой плотную vision-language модель на базе Alibaba Qwen3.8-27B, а Holo4-35B-A3B использует разреженную mixture-of-experts архитектуру на базе Alibaba Qwen3.6-35B-A3B, причём активны примерно 3B параметров. Для версии 27B в карточке модели указан контекст 262 144 токена.

Весы опубликованы в BF16, FP8, NVFP4 и четырёхбитном GGUF. Это не декоративный набор форматов: H Company позиционирует модели для локального развёртывания, включая конфигурации на одном GPU, хотя конкретные требования зависят от выбранного представления весов.

В официальных материалах H Company плотная модель набрала 61,7% на OSWorld 2.0, а MoE-версия получила 30,9%. На OSWorld указаны уже 85,2% и 80,8% при заявленной стоимости задачи 0,08 и 0,05 доллара соответственно. Эти цифры нельзя смешивать: версии бенчмарка и протоколы оценки различаются.

Почему открытые веса здесь действительно меняют расклад

Главное изменение простое: компьютерного агента теперь можно изучать и разворачивать без обязательной привязки к закрытому API. Открытые и квантованные веса дают возможность воспроизводить оценки, менять контур исполнения и проверять поведение модели на собственных интерфейсах.

Но результаты сразу показывают неприятный инженерный нюанс: меньше активных параметров ещё не означает сопоставимое качество действий. Holo4-35B-A3B потенциально интереснее по стоимости исполнения, однако в приведённых тестах он уступает плотной версии, особенно на OSWorld 2.0. Экономия вычислений имеет смысл только там, где ошибки агента не съедают её целиком.

Я бы в первую очередь смотрел не на красивую строку рейтинга, а на устойчивость длинных последовательностей действий, задержку визуального цикла и восстановление после неверного клика. Открытые веса делают такую проверку возможной, но не гарантируют результат. Теперь главный вопрос в том, перенесётся ли преимущество Holo4-27B из официальных таблиц в живые, меняющиеся интерфейсы.

Ранее мы разбирали отказ Anthropic от тихого понижения качества ответов Claude и то, что эта история показала о прозрачности моделей. Эта дискуссия полезна для оценки выводов исследователя Humanistic AI о моделях.