Anthropic holt Prüfer ins Labor – bezahlt werden sie vorerst selbst

Anthropic kündigte am 18. September 2026 eine Partnerschaft mit Accenture an: Ein Team des Beratungsunternehmens soll innerhalb des KI-Labors Modelle und Sicherheitsprozesse prüfen. Der Reuters-Bericht über die Vereinbarung bestätigt das Datum, die geplante Rolle von Faculty und die Erwartung beider Unternehmen, über fünf Jahre jeweils mindestens eine Milliarde US-Dollar in entsprechende Kapazitäten zu investieren.
Die sogenannten Embedded Evaluators sollen mehr Einblick erhalten als Prüfer, die erst ein bereitgestelltes Modell untersuchen. Laut Anthropics Ankündigung ist ein mit Beschäftigten vergleichbarer Zugang vorgesehen: Das Team soll Modelle während des Trainings beobachten, Entwicklungs- und Einsatzentscheidungen nachvollziehen und direkt mit Mitarbeitern sprechen können. Zugleich finanziert Anthropic die Arbeit von Accenture zunächst selbst; gemeinsame Regeln für Zugang, Berichte und Finanzierung existieren nach Darstellung des Unternehmens noch nicht.
Was die Prüfer innerhalb von Anthropic sehen sollen
Die fachliche Leitung übernimmt Faculty, Accentures auf künstliche Intelligenz spezialisiertes Geschäft. Zum angekündigten Mandat gehören Modellbewertungen, Red-Teaming, Alignment-Prüfungen und Tests der Schutzmechanismen. Darüber hinaus sollen die Evaluatoren untersuchen, ob Anthropic eigene Sicherheitszusagen einhält, und Schwachstellen erkennen, die aus größerer Distanz möglicherweise verborgen blieben.
Der entscheidende Unterschied zu einer nachgelagerten externen Prüfung ist damit nicht allein die Auswahl der Tests, sondern die Nähe zum Entstehungsprozess. Das Team soll beobachten können, wie Modelle im Training Gestalt annehmen und welche Entscheidungen ihren Aufbau und späteren Einsatz bestimmen. Bei einem Test erst vor der Veröffentlichung bleiben solche internen Abläufe gewöhnlich außerhalb des eigentlichen Prüfgegenstands.
Der versprochene Zugang ist allerdings noch kein nachgewiesenes Prüfergebnis. Anthropic beschreibt ein Modell, dessen Einzelheiten erst ausgearbeitet werden; veröffentlicht sind bislang weder ein abgeschlossener Prüfzyklus noch Befunde von Accenture. Auch die Größe und genaue Zusammensetzung des Teams wurden in den Ankündigungen nicht genannt.
Organisatorisch getrennt, finanziell vorerst abhängig
Anthropic bezeichnet die geplante Evaluation als unabhängig. Dafür spricht zunächst, dass die Prüfer bei Accenture angesiedelt sind und die Partnerschaft nicht exklusiv sein soll: Anthropic will weitere Organisationen beteiligen, während Accenture vergleichbare Aufgaben auch für andere KI-Entwickler übernehmen kann. Eine solche Trennung schafft eine zusätzliche Perspektive, beseitigt aber nicht automatisch alle Interessenkonflikte.
Der deutlichste Zielkonflikt liegt in der Finanzierung. Das geprüfte Unternehmen bezahlt die Arbeit seines Prüfers direkt. Anthropic hält langfristig gebündelte oder staatliche Mittel für geeigneter, erklärt aber zugleich, dass derzeit weder ein solches Finanzierungssystem noch ein gemeinsamer Branchenstandard besteht.
Auch die angekündigten Investitionen sind enger zu lesen, als die Gesamtsumme vermuten lässt. Beide Unternehmen erwarten Ausgaben von jeweils mindestens einer Milliarde US-Dollar über fünf Jahre; das sind Zukunftserwartungen und keine bereits ausgezahlten zwei Milliarden Dollar. Die Veröffentlichungen weisen außerdem nicht aus, welcher Anteil an das eingebettete Team geht oder wie viel für andere Stellen, Testprogramme und Sicherheitskapazitäten vorgesehen ist.
Zugang garantiert noch keine Berichtsfreiheit
Für die tatsächliche Unabhängigkeit sind vier Punkte entscheidend: Wer bestimmt den Prüfrahmen, welche Informationen darf das Team einsehen, an wen berichtet es und welche Befunde darf es ohne Zustimmung von Anthropic veröffentlichen? Der angekündigte mitarbeiterähnliche Zugang beantwortet die zweite Frage nur grundsätzlich. Ein verbindlicher Rechtekatalog, Eskalationswege und Publikationsregeln sind bislang nicht öffentlich beschrieben.
Anthropic nennt auch das Melden von Vorfällen und eine besser informierte öffentliche Bewertung von Nutzen und Risiken als mögliche Funktionen eingebetteter Prüfer. Daraus folgt jedoch noch nicht, dass Accenture Erkenntnisse eigenständig veröffentlichen darf. Ungeklärt bleibt insbesondere, was geschieht, wenn Prüfer und Entwickler eine Schwachstelle oder die geplante Freigabe eines Modells unterschiedlich bewerten.
Das unterscheidet fachlichen Zugang von institutioneller Unabhängigkeit. Ein Team kann tief in Trainings- und Entwicklungsprozesse blicken und dennoch durch Vertrag, Vertraulichkeit oder Berichtslinien begrenzt sein. Umgekehrt wäre auch eine formal unabhängige Organisation wenig wirksam, wenn ihr die Informationen fehlen, die für eine belastbare Bewertung nötig sind.
Warum die Wahl auf Accenture fällt
Accenture bringt nach Darstellung der Partner Erfahrung mit dem Einsatz von KI in Unternehmen und Behörden ein. Anthropic begründet die Wahl damit, dass dieser Praxisbezug Risiken sichtbar machen könne, die rein technische Modelltests nicht erfassen. Faculty soll dafür die technische und sicherheitsbezogene Expertise stellen.
Die Entscheidung fiel dennoch auf einen anderen Akteurstyp, als manche Beobachter erwartet hatten. TechCrunch ordnet Accenture als ersten eingebetteten Evaluator ein und berichtet zugleich, dass weitere Prüfer angekündigt werden sollen und Gespräche mit METR sowie anderen gemeinnützigen Organisationen über eigenfinanzierte Pilotprojekte laufen.
Mehrere Prüforganisationen mit unterschiedlichen Finanzierungswegen könnten die Abhängigkeit von einem einzelnen Auftragnehmer verringern. Noch ist das jedoch eine angekündigte Richtung und kein bestehendes Kontrollsystem: Für die weiteren Teams liegen weder Namen noch Mandate, gemeinsame Verfahren oder Resultate vor.
Die Bewährungsprobe beginnt mit den ersten Befunden
Bestätigt sind bislang die Partnerschaft, das vorgesehene Aufgabenfeld, der grundsätzlich tiefe Zugang und die direkte Finanzierung von Accenture durch Anthropic. Offen bleiben Teamgröße, konkrete Zugriffsrechte, Berichtslinien, Veröffentlichungsregeln und die Verteilung der erwarteten Investitionen.
Der Ansatz rückt externe Kontrolle näher an Training und Entwicklungsentscheidungen heran. Ob daraus eine robustere Aufsicht entsteht, lässt sich erst beurteilen, wenn das Team arbeitet, Befunde vorlegt und erkennbar wird, wie Anthropic mit kritischen Ergebnissen umgeht. Die entscheidende Frage ist daher nicht nur, was die Prüfer sehen dürfen, sondern auch, ob und wie sie darüber unabhängig berichten können.
Lesen Sie auch:
Newsletter abonnieren
Erhalten Sie die neuesten Nachrichten zu Web3, KI und Krypto direkt in Ihren Posteingang.