Holo4: Offene Modelle für Computeragenten
Holo4компьютерные агентыоткрытые модели
Was H Company konkret veröffentlicht hat
Entscheidend ist hier nicht allein die Modellgröße, sondern der praktische Fokus des Releases: Holo4 soll Web, Desktop und mobile Oberflächen bedienen. In der Ankündigung von H Company vom 28. September 2026 wird die Familie als generalistische Computer-Use-Modelle mit offenen Gewichten vorgestellt.
Die Reihe umfasst zwei unterschiedliche Architekturen. Holo4-27B ist ein dichtes Vision-Language-Modell auf Basis von Alibaba Qwen3.8-27B, während Holo4-35B-A3B eine sparsame Mixture-of-Experts-Architektur auf Basis von Alibaba Qwen3.6-35B-A3B verwendet; aktiv sind dabei ungefähr 3B Parameter. Für die 27B-Version nennt die Modellkarte ein Kontextfenster von 262.144 Tokens.
Die Gewichte erscheinen in BF16, FP8, NVFP4 und vierbitigem GGUF. Das ist keine rein dekorative Formatauswahl: H Company positioniert die Modelle für lokale Bereitstellung, auch in Konfigurationen mit nur einer GPU. Die konkreten Hardwareanforderungen hängen allerdings von der gewählten Gewichtsrepräsentation ab.
Nach offiziellen Angaben von H Company erreichte das dichte Modell 61,7 % auf OSWorld 2.0, die MoE-Version 30,9 %. Für OSWorld werden 85,2 % und 80,8 % genannt, bei ausgewiesenen Kosten pro Aufgabe von 0,08 beziehungsweise 0,05 Dollar. Diese Werte dürfen nicht zusammengeworfen werden, da sich Benchmark-Versionen und Evaluierungsprotokolle unterscheiden.
Warum offene Gewichte die Lage wirklich verändern
Die zentrale Veränderung ist einfach: Ein Computeragent lässt sich nun untersuchen und betreiben, ohne zwingend an eine geschlossene API gebunden zu sein. Offene und quantisierte Gewichte ermöglichen es, Bewertungen zu reproduzieren, den Ausführungsstack anzupassen und das Modellverhalten auf eigenen Oberflächen zu prüfen.
Die Ergebnisse zeigen jedoch auch eine unangenehme technische Nuance: Weniger aktive Parameter bedeuten nicht automatisch eine vergleichbare Aktionsqualität. Holo4-35B-A3B könnte bei den Ausführungskosten attraktiver sein, liegt in den genannten Tests aber hinter der dichten Variante, besonders bei OSWorld 2.0. Rechenersparnis ist nur dann sinnvoll, wenn Fehler des Agenten sie nicht vollständig aufzehren.
Ich würde nicht zuerst auf eine attraktive Zeile in der Rangliste schauen, sondern auf die Stabilität langer Aktionsfolgen, die Latenz des visuellen Zyklus und die Erholung nach einem Fehlklick. Offene Gewichte machen diese Prüfung möglich, garantieren aber kein gutes Ergebnis. Die entscheidende Frage lautet, ob sich der Vorteil von Holo4-27B aus den offiziellen Tabellen auf lebendige, wechselhafte Oberflächen übertragen lässt.