Holo4 öffnet Computersteuerung für lokale KI-Agenten
28. September 2026

H Company veröffentlicht Holo4 mit offenen Gewichten für Bildschirm, Code, MCP und APIs. Die Modelle sind prüfbarer als geschlossene Agenten, ihre Benchmarks brauchen aber Kontext.
Worum es geht
H Company hat am 28. September 2026 die Modellfamilie Holo4 veröffentlicht. Sie soll Software nicht nur über eine einzelne Schnittstelle bedienen, sondern je nach Aufgabe klicken, tippen, Code ausführen sowie MCP- oder API-Werkzeuge aufrufen. Die Gewichte stehen in mehreren Formaten auf Hugging Face bereit. Das macht die Veröffentlichung für Entwickler interessant, die Computersteuerung selbst betreiben, untersuchen oder an eigene Abläufe anpassen wollen.
Holo4 erscheint als dichtes 27-Milliarden-Parameter-Modell und als Mixture-of-Experts-Modell mit 35 Milliarden Gesamtparametern und 3 Milliarden aktiven Parametern. Hinzu kommt Holotron4 Nano. Die eigentliche Neuigkeit ist weniger eine einzelne Bestmarke als die Kombination aus offenen Gewichten, mehreren Bedienwegen und veröffentlichten Ausführungsspuren.
Was Holo4 tatsächlich macht
Ein Holo4-Agent kann Bildschirminhalte auswerten und Maus- oder Tastaturaktionen erzeugen. Wenn eine Anwendung bessere Schnittstellen bietet, kann dasselbe Modell stattdessen Code, MCP oder APIs verwenden. Laut H Company wurde es mit überwachtem Lernen und Reinforcement Learning auf interaktiven Umgebungen trainiert. Eine interne „Agentic Task Factory“ habe rund 10.000 Aufgaben aus Dokumentationen erzeugt.
Auf OSWorld 2.0 nennt H Company für Holo4-27B einen Wert von 61,7 Prozent. Im selben Vergleich führt das Unternehmen für Claude Opus 5.5 81,8 Prozent an. Holo4-35B-A3B erreicht dort 30,9 Prozent. Diese Zahlen stammen aus unterschiedlichen Veröffentlichungen, Teilmengen und Ausführungsumgebungen; sie sind daher kein sauberer Direktvergleich. Positiv ist, dass H Company die Trajektorien öffentlicher Benchmark-Läufe zum Nachspielen und Herunterladen anbietet.
Warum das wichtig ist
Computersteuernde Agenten sind oft schwer zu prüfen: Ein Endwert zeigt, ob eine Aufgabe gelang, aber nicht zuverlässig, welche Zwischenentscheidungen riskant waren. Offene Gewichte und Trajektorien erlauben Forschern und Sicherheitsteams, Fehler genauer zu untersuchen. Das ist besonders relevant, wenn Agenten mit Dateien, Browser-Sitzungen oder geschäftlichen Systemen arbeiten.
Für kleinere Anbieter entsteht außerdem eine Alternative zu vollständig geschlossenen Diensten. Die bereitgestellten BF16-, FP8-, NVFP4- und 4-Bit-GGUF-Varianten eröffnen verschiedene Betriebsformen. „Offen“ bedeutet hier jedoch nicht automatisch günstig oder lokal auf jedem Rechner: Ein 27B-Modell braucht weiterhin erhebliche Rechenleistung, und lange Aufgaben können sehr viele Modellaufrufe und Token verbrauchen.
Einfach erklärt
Stellen Sie sich einen Handwerker vor, der nicht nur einen Schraubendreher kennt. Vor einer Aufgabe entscheidet er, ob er einen Schlüssel, eine Bohrmaschine oder den direkten Zugang zur Steuerung verwendet. Holo4 soll ähnlich zwischen Bildschirm, Code und Schnittstellen wechseln. Die veröffentlichten Trajektorien sind dabei wie ein Arbeitsprotokoll: Man sieht nicht nur das fertige Regal, sondern auch jeden angesetzten Handgriff.
Praktisches Beispiel
Ein mittelständisches Unternehmen möchte jeden Morgen 120 Lieferantenrechnungen aus einem alten Desktopprogramm prüfen. Der Agent liest den Bildschirm, übernimmt strukturierte Daten über eine API, gleicht Beträge per Skript ab und markiert zehn unklare Fälle für Menschen. Vor einem echten Einsatz testet das Team 500 historische Rechnungen in einer isolierten Umgebung.
Wenn der Agent 460 Fälle korrekt bearbeitet, 25 sauber eskaliert und 15 falsch einordnet, liegt die entscheidende Arbeit nicht in einer schönen Demo. Das Team muss die 15 Fehler analysieren, Berechtigungen begrenzen und festlegen, dass Zahlungen niemals automatisch freigegeben werden. Holo4 liefert dafür technische Bausteine, aber keine fertige Prozesskontrolle.
Einordnung und Grenzen
Erstens stammen zentrale Leistungsangaben vom Hersteller. Selbst veröffentlichte Trajektorien ersetzen keine unabhängige Replikation auf identischen Aufgaben und identischer Hardware. Zweitens können Bildschirmagenten durch veränderte Oberflächen, Pop-ups oder irreführende Inhalte scheitern. Drittens lösen offene Gewichte keine Sicherheitsfrage automatisch: Sandboxing, minimale Rechte, Protokollierung und menschliche Freigaben bleiben nötig.
Holo4 ist deshalb kein Beleg dafür, dass allgemeine Büroarbeit nun zuverlässig autonom läuft. Die Beispiele von H Company zeigen anspruchsvolle Aufgaben, aber auch sehr hohe Aufruf- und Tokenzahlen. Wer das Modell einsetzt, sollte Erfolg, Kosten und unerwünschte Aktionen im eigenen Ablauf messen.
SEO- und GEO-Schlüsselbegriffe
Holo4, H Company, Computer Use, KI-Agenten, Open Weights, Hugging Face, OSWorld 2.0, MCP, GUI-Automatisierung, lokale KI, Agentensicherheit
💡 Im Klartext
Holo4 ist eine offene Modellfamilie, die Programme über Bildschirm, Code und Schnittstellen bedienen kann. Entwickler können Gewichte und Beispielabläufe prüfen, müssen den Agenten aber weiterhin isolieren und eng begrenzen.
Wichtigste Erkenntnisse
- →Holo4-27B und Holo4-35B-A3B stehen mit offenen Gewichten in mehreren Formaten bereit.
- →Die Modelle können GUI-Aktionen, Code, MCP und APIs innerhalb eines Ablaufs kombinieren.
- →H Company veröffentlicht Trajektorien öffentlicher Benchmark-Läufe zur Prüfung.
- →Der gemeldete OSWorld-Wert von 61,7 Prozent für Holo4-27B ist kein vollständig unabhängiger Vergleich.
- →Sandboxing, minimale Rechte und menschliche Freigaben bleiben für reale Einsätze notwendig.
Häufige Fragen
Ist Holo4 Open Source?
Die Modellgewichte und mehrere Varianten sind auf Hugging Face verfügbar. Vor einer Nutzung sollten Entwickler dennoch die jeweilige Lizenz der konkreten Modellkarte prüfen.
Kann Holo4 Programme ohne API bedienen?
Ja. Das Modell ist für Maus- und Tastaturaktionen auf grafischen Oberflächen ausgelegt und kann zusätzlich Code, MCP oder APIs verwenden.
Läuft Holo4 auf jedem Laptop?
Nein. Selbst quantisierte Varianten eines 27B-Modells benötigen beträchtliche Rechenleistung und Speicher; die praktische Geschwindigkeit hängt stark von Hardware und Kontextlänge ab.
Sind die Benchmarks unabhängig bestätigt?
Die Veröffentlichung enthält prüfbare Trajektorien, doch zentrale Zahlen stammen von H Company. Unabhängige Replikationen bleiben wichtig.