Palo Alto setzt mehrere KI-Modelle auf Sicherheitslücken an – aus gutem Grund

|Autor: QUASA-Redaktion|5 Min. Lesezeit| 1
Palo Alto setzt mehrere KI-Modelle auf Sicherheitslücken an – aus gutem Grund

Palo Alto Networks kündigte am 22. September 2026 in Santa Clara Unit 42 Continuous Frontier AI Defense als weltweit verfügbaren Jahresabodienst an. Der Dienst soll Unternehmenssysteme fortlaufend auf Schwachstellen prüfen, mögliche Angriffspfade validieren und Empfehlungen zur Behebung liefern. Dafür verbindet die Sicherheitseinheit Unit 42 Modelle von Anthropic und OpenAI mit weiteren Modellen und der Arbeit ihrer Fachleute.

Der Modellmix hat einen konkreten Grund: Der Axios-Bericht über die Herstellertests hält fest, dass kein einzelnes Modell mehr als 40 Prozent der Schwachstellen in einer komplexen Unternehmensumgebung fand; die Funde von Claude Mythos 5 und GPT-5.6-Cyber überschnitten sich zu weniger als zehn Prozent. Die Modelle liefern demnach unterschiedliche Hinweise. Wie viele vorhandene Schwachstellen der neue Dienst insgesamt erkennt, belegen diese Werte noch nicht.

Warum Unit 42 die Modelle kombiniert

Unit 42 setzt auf eine eigene Steuerung, die unterschiedliche Prüfaufgaben an ein dafür geeignetes Modell verteilt. Zum Angebot gehören eingeschränkt zugängliche Modelle von Anthropic und OpenAI sowie Modelle mit offen verfügbaren Gewichten. Bedrohungsinformationen und die Erfahrung der Sicherheitsteams sollen helfen, die Ergebnisse einzuordnen. Der Dienst ist damit als Zusammenspiel mehrerer Suchansätze konzipiert, nicht als wiederholter Aufruf desselben Modells.

Die geringe Überschneidung erklärt den Ansatz: Wenn verschiedene Modelle andere potenzielle Schwächen entdecken, kann ihre Kombination blinde Flecken eines einzelnen Modells verringern. Daraus folgt jedoch keine bestimmte Erkennungsrate für die Kombination. Dafür müsste auch bekannt sein, wie groß die Menge aller tatsächlich vorhandenen Schwachstellen war und welche gemeldeten Funde sich nach einer Prüfung als belastbar erwiesen.

Auch die Wahl des Modells ist nur ein Teil der Leistung. Die Steuerung muss passende Aufgaben zuweisen, Ergebnisse zusammenführen und Funde von bloßen Vermutungen trennen. Ein mehrfach gemeldeter Fehler ist nicht automatisch ausnutzbar; umgekehrt kann ein einzelner Fund erst im Zusammenhang mit anderen Schwächen kritisch werden. Genau diesen Zusammenhang soll die anschließende Validierung von Angriffspfaden untersuchen.

Wie aus Scans überprüfte Angriffspfade werden

Der Ablauf beginnt mit einem Grundscan der einbezogenen Umgebung. Der Einführungsbeitrag von Unit 42 beschreibt darauf folgende Prüfungen, die bei Änderungen der Umgebung weiterlaufen. „Kontinuierlich“ meint hier also eine laufende Untersuchung veränderlicher Systeme. Die veröffentlichte Beschreibung legt weder für jedes Prüfziel ein festes Intervall fest noch erklärt sie im Detail, welche Änderung einen neuen Test auslöst.

Zum genannten Prüfumfang gehören eigene und fremde Webanwendungen, APIs, Cloud-Infrastruktur, Quellcode-Repositories und Netzwerkressourcen. Statt einen gefundenen Fehler nur einzeln zu melden, soll der Dienst untersuchen, ob sich mehrere Schwächen zu einem durchgehenden Angriffspfad verbinden lassen. Das ist für die Priorisierung relevant: Ein vorhandener Fehler sagt für sich genommen weniger über das Risiko aus als ein validierter Weg zu einem erreichbaren Ziel.

Wie umfassend diese Prüfung bei einem Kunden ausfällt, hängt von den tatsächlich einbezogenen Systemen ab. Die öffentliche Beschreibung nennt Arten von Ressourcen, aber keine vollständige Liste benötigter Zugriffsrechte und technischer Grenzen. Aus dem Anspruch eines Grundscans der Unternehmensumgebung lässt sich daher nicht ableiten, dass ohne Einrichtung jede Anwendung und jede Netzwerkressource erfasst wird. Für die Bewertung eines Ergebnisses bleibt der vereinbarte Prüfumfang entscheidend.

Zwischen Befund und Behebung

Nach der Validierung sieht der beschriebene Ablauf priorisierte Empfehlungen vor, darunter Hinweise zu Änderungen am Code und Vorschläge für virtuelle Patches. Bei virtuellen Patches kann der Dienst mit dem separaten Angebot Frontier Virtual Patching verbunden werden. Die Empfehlung einer Maßnahme ist allerdings noch keine Ausbringung auf Kundensystemen. Die veröffentlichten Angaben belegen nicht, dass der neue Dienst Änderungen ohne Freigabe selbstständig vornimmt.

Unit 42 stellt die Beteiligung eigener Sicherheitsexperten als Teil des Angebots dar. Welche einzelnen Tests oder Änderungen eine Zustimmung des Kunden erfordern und wie Ergebnisse in bestehende Freigabeprozesse gelangen, bleibt öffentlich unklar. Diese Fragen betreffen den Betrieb unmittelbar: Die Validierung eines Angriffspfads braucht einen abgegrenzten Prüfbereich, während eine Änderung an produktiven Systemen andere Verantwortlichkeiten auslöst. Die Beschreibung verbindet Suche, Validierung und Empfehlungen, erläutert aber nicht jeden Entscheidungsschritt dazwischen.

Was die Herstellerwerte offenlassen

Die veröffentlichten Testwerte erklären, weshalb Unit 42 mehrere Modelle einsetzt; sie sind kein unabhängiger Leistungsvergleich des Abodienstes. Angaben zu einem einzelnen Modell lassen sich ebenso wenig auf den gesamten Dienst übertragen wie die geringe Überschneidung zweier Modelle. Für eine überprüfbare Gesamtquote wären unter anderem die Auswahl der untersuchten Umgebungen, eine bestätigte Vergleichsmenge und der Umgang mit Fehlalarmen nötig.

Der Dienst ist weltweit im Jahresabonnement verfügbar. Die angebotenen Varianten unterscheiden sich nach der Auswahl der eingesetzten Modelle; die Steuerung über mehrere Modelle gehört zu allen Varianten. Konkrete Preise nennen die ausgewerteten öffentlichen Produktangaben nicht. Auch für die laufende Nutzung fehlen dort vergleichbar aufgeschlüsselte Daten dazu, wie häufig gemeldete Schwachstellen bestätigt werden und wie schnell empfohlene Maßnahmen tatsächlich umgesetzt werden.

Damit ist der Stand der Geschichte umrissen: Der Dienst ist erhältlich, sein Prüfprozess ist beschrieben und die unterschiedlichen Modellfunde begründen den gewählten Ansatz. Ob er in verschiedenen Kundenumgebungen zuverlässig mehr relevante Schwachstellen findet und deren Behebung beschleunigt, lässt sich aus den bisher veröffentlichten Herstellerwerten allein nicht beurteilen. Dafür wären nachvollziehbare Ergebnisse aus dem laufenden Einsatz erforderlich.

Lesen Sie auch:

Teilen:

Newsletter abonnieren

Erhalten Sie die neuesten Nachrichten zu Web3, KI und Krypto direkt in Ihren Posteingang.

0