OpenAI-Rivalen, Anthropic

Auch KI des OpenAI-Rivalen Anthropic griff echte Firmen an

Veröffentlicht am: 31.07.2026 um 06:15 Uhr | dpa, AD HOC NEWS

Wenige Wochen nach der aufsehenerregenden Hacker-Attacke eines KI-Modells des ChatGPT-Entwicklers OpenAI muss der Rivale Anthropic einrĂ€umen, dass ihm etwas Ähnliches passiert ist.

In TestlĂ€ufen drang KĂŒnstliche Intelligenz von Anthropic ungeplant in Computersysteme von drei Unternehmen ein, wie die KI-Firma mitteilte. Weder die Betroffenen noch Anthropic hĂ€tten das damals bemerkt. Man habe die AktivitĂ€t erst bei einer nachtrĂ€glichen ÜberprĂŒfung von gut 141.000 TestlĂ€ufen nach dem OpenAI-Vorfall festgestellt. Namen der Unternehmen wurden zunĂ€chst nicht genannt.

WĂ€hrend die OpenAI-KI erst einen Weg finden musste, aus der Testumgebung ins offene Internet auszubrechen, hatten es die Modelle von Anthropic viel einfacher. Im Test-Szenario, das sie bekamen, hieß es zwar, sie hĂ€tten keinen Netz-Zugang. Doch in Wirklichkeit war der Weg ins Internet wegen eines MissverstĂ€ndnisses mit dem Test-Partner die ganze Zeit frei. Drei Modelle machten davon dann auch Gebrauch, wie Anthropic in einem Blogeintrag erlĂ€uterte.

In allen Tests ging es darum, die Hacker-FĂ€higkeiten der KI zu testen. Das ist eine ĂŒbliche Vorgehensweise, um besser Leitplanken fĂŒr sie aufstellen zu können. Konkret bekamen die KI-Modelle die Aufgabe, eine bestimmte Information zu finden, die in einem anderen Computer versteckt ist - und dafĂŒr auch in das System einzubrechen.

Namensverwechslung

Bei einem der ZwischenfĂ€lle wĂ€hlte der Testpartner laut Anthropic im Szenario fĂŒr die zu hackende fiktive Firma einen Namen, der sich auch in einer tatsĂ€chlichen Web-Adresse findet. Die KI - Anthropics Modell Claude Opus 4.7 - habe sich erst schwer damit getan, die Aufgabe in der vorgesehenen Testumgebung zu erfĂŒllen. Dann habe die Software aber festgestellt, dass sich im Internet ein Unternehmen mit demselben Namen fand - und sich darauf konzentriert. Das sei gleich bei vier DurchlĂ€ufen passiert. Dabei verschaffte sich das Modell demnach unter anderem Zugriff auf eine Datenbank. Auch als die KI erkannt habe, dass es sich um ein echtes Unternehmen handelte, sei die Attacke nicht gestoppt worden.

Schadsoftware zum Herunterladen

In einem anderen Test schrieb das Anthropic-Programm dem Blogeintrag zufolge fĂŒr den Einbruch in den Ziel-Computer eine prĂ€parierte Software. Dank Netz-Zugang habe sie diese jedoch öffentlich zugĂ€nglich auf einer spezialisierten Download-Plattform platzieren können. Dort sei die Schadsoftware rund eine Stunde lang verfĂŒgbar gewesen - und 15 Systeme hĂ€tten sie heruntergeladen.

Darunter war demnach eine IT-Sicherheitsfirma, die routinemĂ€ĂŸig solche Scripts lĂ€dt und ausfĂŒhrt, um sie zu testen. Durch die Installation habe das Anthropic-Modell Mythos 5 Zugang zur Computer-Infrastruktur der Firma bekommen. Das Verhalten der KI sei nicht ideal gewesen, hieß es dazu im Blogeintrag.

Beim dritten Zwischenfall habe ein Test-Modell rund 9.000 Angriffsziele gescannt, bevor es sich fĂŒr eines davon entschieden habe. Diesmal stoppte die KI die Attacke, als sie erkannte, dass es sich um ein echtes Unternehmen handelte, wie Anthropic schrieb.

OpenAI-Vorfall als Weckruf

Bei dem jĂŒngst bekanntgewordenen Vorfall mit einem Modell von OpenAI verschaffte sich die Software in einem Test eigenstĂ€ndig Zugang zum offenen Internet und drang danach auf eigene Faust in Computersysteme der KI-Firma Hugging Face ein. Dabei agierte die OpenAI-KI wie ein Hacker und nutzte unentdeckt gebliebene SicherheitslĂŒcken aus. Der ChatGPT-Entwickler sprach von einem "beispiellosen Cyber-Zwischenfall".

Experten warnen schon lange vor Cyberattacken mit KI-Software. Deswegen wurde der OpenAI-Zwischenfall in der Branche als Weckruf gewertet. Es folgten unter anderem Forderungen, die Testumgebungen besser abzusichern. FĂŒr Anthropic sind die nun bekanntgewordenen Attacken besonders schmerzhaft, da die Firma stets als Verfechter einer verantwortungsvollen KI-Entwicklung auftrat.

Disclaimer...

de | boerse | 69903259 |