Sicherheitsforscher hackten OpenAI mit Hilfe von Anthropics Claude
Ein Experiment mit fremder KI-Technologie legte offen, wie tief Schwachstellen in den Systemen von OpenAI reichen konnten.
US-Sicherheitsforscher haben OpenAI im Rahmen eines autorisierten Tests gehackt und dabei auf den Chatbot Claude des Konkurrenzunternehmens Anthropic zurückgegriffen.
Nach eigenen Angaben der Forscher war der Umfang dessen, was theoretisch zugänglich gewesen wäre, erheblich. Der Test fand mit Zustimmung von OpenAI statt und zählt damit zur Kategorie des sogenannten ethischen Hackens, bei dem Schwachstellen gezielt aufgedeckt werden, um sie zu schließen, bevor Dritte sie ausnützen können.
Wie ethisches Hacking funktioniert
Beim sogenannten Penetration Testing beauftragen Unternehmen externe Fachleute, ihre eigenen Systeme anzugreifen. Ziel ist es, Lücken zu finden, bevor es echte Angreifer tun. Im konkreten Fall setzten die Forscher Claude, das KI-Modell von Anthropic, als Werkzeug ein, um Schwachstellen in der Infrastruktur von OpenAI zu identifizieren.
Dass ausgerechnet die Technologie eines direkten Konkurrenten zum Aufspüren von Sicherheitslücken verwendet wurde, zeigt, wie sich die Grenzen zwischen den großen KI-Anbietern in der Praxis verwischen.
Beide Unternehmen entwickeln Sprachmodelle, die auf riesigen Rechenzentren mit tausenden Grafikprozessoren trainiert werden, und beide sind auf robuste Sicherheitsarchitekturen angewiesen, um Kundendaten, Trainingsdaten und Modellgewichte zu schützen.
Was auf dem Spiel steht
OpenAI verarbeitet nach eigenen Angaben täglich Anfragen von hunderten Millionen Nutzern über Produkte wie ChatGPT. Ein erfolgreicher Angriff auf die zugrunde liegende Infrastruktur könnte theoretisch Zugriff auf sensible Systeme, interne Modelldaten oder Nutzerinformationen ermöglichen. Die Forscher betonten, dass der potenzielle Zugriffsbereich, den sie während des Tests hätten erreichen können, deutlich größer war als ursprünglich angenommen.
Solche Tests sind in der Softwarebranche seit Jahrzehnten etabliert, gewinnen aber im Bereich der künstlichen Intelligenz eine neue Dimension. KI-Systeme verarbeiten nicht nur klassische Daten, sondern auch Trainingsmaterial, Modellarchitekturen und in manchen Fällen firmeneigene Algorithmen, deren Wert sich nur schwer in klassischen IT-Sicherheitskategorien abbilden lässt.
Konkurrenz und Kooperation zugleich
OpenAI und Anthropic stehen im harten Wettbewerb um Marktanteile, Investorengelder und die technologische Führungsrolle bei generativer KI.
Anthropic wurde 2021 von ehemaligen OpenAI-Mitarbeitern gegründet und hat seither Milliarden an Investitionen unter anderem von Amazon und Google erhalten. Dass Claude nun als Werkzeug half, Schwachstellen bei OpenAI aufzudecken, zeigt, dass technische Sicherheitsfragen unabhängig von Marktrivalitäten behandelt werden können.
Die Episode fügt sich in eine breitere Entwicklung ein, in der Cybersicherheit zum zentralen Thema der gesamten KI-Branche wird. Je mehr Unternehmen und Behörden auf Sprachmodelle für sensible Aufgaben setzen, desto attraktiver werden diese Systeme als Angriffsziel für staatliche Akteure, Kriminelle oder Wettbewerber.
Für europäische Nutzer und Unternehmen ist die Sicherheit von KI-Infrastruktur direkt relevant, da viele heimische Firmen und Behörden Dienste von OpenAI und Anthropic über Cloud-Partner wie Microsoft Azure oder Amazon Web Services einsetzen.
Österreichische Unternehmen, die ChatGPT oder Claude in Geschäftsprozesse integriert haben, sind von der Sicherheitsarchitektur dieser Anbieter mittelbar abhängig. Die EU-KI-Verordnung, die schrittweise ab 2025 in Kraft tritt, verlangt von Anbietern sogenannter Hochrisiko-KI-Systeme dokumentierte Sicherheitsmaßnahmen, wodurch Tests wie der beschriebene auch regulatorisch an Bedeutung gewinnen.
Quelle: theguardian.com | Originalartikel