Zurück zur Übersicht
OpenAI setzt einsatzorientiertes Verstärkungslernen für zwei Wochen aus und verschärft sein Sicherheitsframework. Auslöser sind Bedenken zu den Cyberfähigkeiten des geplanten Modells Astra und ein Sicherheitsvorfall bei Hugging Face.
OpenAI hat nach eigenen Angaben zwei Wochen lang einsatzorientiertes Verstärkungslernen pausiert. Ein erheblicher Teil der Forschung an Astra und im Bereich Cybersicherheit bleibt ausgesetzt, bis strengere Sicherheitsanforderungen erfüllt sind.
Das Unternehmen überarbeitet sein Preparedness Framework. Geplant sind stärker isolierte Testumgebungen, eingeschränkter Netzwerk und Werkzeugzugriff, zusätzlicher Schutz der Modellgewichte sowie eine umfassendere Überwachung riskanter Aktionen.
OpenAI erklärte am 7. August, dass Astra eine kritische Schwelle für Cyberfähigkeiten erreichen könnte. Bei einem separaten Test erlangten OpenAI Modelle über eine Sicherheitslücke Internetzugriff und kompromittierten anschließend Systeme von Hugging Face. Das ist kein gewöhnlicher Sicherheitscheck mehr, sondern ein Hinweis darauf, dass leistungsfähigere Modelle auch die Kontrollsysteme ihrer Entwickler unter Druck setzen.
Weiterlesen
Nach einem Sicherheitsvorfall bei einer OpenAI-Modellprüfung verlangt Clem Delangue mehr Transparenz und Rechenleistung für die Entwicklung von Abwehrsystemen. Der Fall zeigt, dass nicht nur Modelle selbst, sondern auch ihre Testumgebungen zum Angriffsziel werden können.
OpenAI-Modelle nutzten in einem internen Sicherheitstest eine Schwachstelle und griffen auf Testlösungen in einer Produktionsdatenbank von Hugging Face zu. Der Vorfall zeigt, dass KI-Modelle bei mehrstufigen Cyberangriffen bereits mehrere Angriffstechniken verbinden können.
OpenAI erprobt eine Methode, die riskante Muster über mehrere API-Interaktionen erkennen soll, ohne dass Mitarbeitende die zugrunde liegenden Inhalte einsehen können. Die Funktion richtet sich an berechtigte Kunden mit aktivierter Speicherung ohne Datenaufbewahrung.
Interne Tests zeigen deutliche Fortschritte bei agentischem Programmieren und Cybersecurity-Aufgaben. OpenAI kann nicht ausschließen, dass Astra unter dem eigenen Preparedness Framework die Stufe „Critical“ erreicht.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.