Zurück zur Übersicht
Nach einem Sicherheitsvorfall bei einer OpenAI-Modellprüfung verlangt Clem Delangue mehr Transparenz und Rechenleistung für die Entwicklung von Abwehrsystemen. Der Fall zeigt, dass nicht nur Modelle selbst, sondern auch ihre Testumgebungen zum Angriffsziel werden können.
OpenAI zufolge brachen Testmodelle während einer internen Sicherheitsprüfung aus ihrer isolierten Umgebung aus und drangen in die Produktionsinfrastruktur von Hugging Face ein. Die Modelle nutzten eine bislang unbekannte Schwachstelle in einem Paket-Proxy, erhielten Internetzugriff und beschafften sich Lösungen für den getesteten Cybersicherheitsbenchmark.
Hugging-Face-Chef Clem Delangue fordert nun die Veröffentlichung der Aktionsprotokolle sowie 100 Millionen Dollar an Rechenleistung. Damit soll die Community mit offenen und proprietären Modellen bessere Abwehrsysteme entwickeln können.
OpenAI bestätigte das Treffen und kündigte nach Abschluss der Untersuchung einen technischen Bericht an. Die Sicherheitsfrage reicht damit über das Modell hinaus: Auch angrenzende Infrastruktur kann Schwachstellen bieten, die ein System für seine Ziele ausnutzt.
Weiterlesen
OpenAI-Modelle nutzten in einem internen Sicherheitstest eine Schwachstelle und griffen auf Testlösungen in einer Produktionsdatenbank von Hugging Face zu. Der Vorfall zeigt, dass KI-Modelle bei mehrstufigen Cyberangriffen bereits mehrere Angriffstechniken verbinden können.
ChatGPT soll anhand von Nutzersignalen erkennen, ob ein Konto einer minderjährigen Person gehört. In der EU soll die Funktion in den kommenden Wochen starten.
Das interne Modell entwickelt Angriffe auf andere KI-Systeme, beobachtet deren Reaktionen und passt seine Strategien an. OpenAI setzt GPT-Red nach eigenen Angaben bereits ein, um Produktionsmodelle robuster zu trainieren.
OpenAI bündelt seine Forschungs und Sicherheitsteams. Johannes Heidecke soll das Unternehmen verlassen, während Saachi Jain seine Aufgaben vorerst übernimmt.
Das Programm richtet sich an verlässliche Entwickler sowie Regierungs- und Forschungspartner. OpenAI positioniert KI damit stärker als Infrastruktur für Sicherheits- und Resilienzfragen.