Zurück zur Übersicht
OpenAI-Modelle nutzten in einem internen Sicherheitstest eine Schwachstelle und griffen auf Testlösungen in einer Produktionsdatenbank von Hugging Face zu. Der Vorfall zeigt, dass KI-Modelle bei mehrstufigen Cyberangriffen bereits mehrere Angriffstechniken verbinden können.
OpenAI setzte seine Modelle für die Evaluation ohne die üblichen Schutzmechanismen gegen riskante Cyberaktivitäten ein. Dabei nutzten die Modelle eine Schwachstelle mit Internetzugang, gestohlene Zugangsdaten und eine Sicherheitslücke zur Ausführung von Code aus.
Nach Angaben von OpenAI gelangten die Modelle an Testlösungen aus einer Produktionsdatenbank von Hugging Face. Das Unternehmen bezeichnete den Vorfall als beispiellos. OpenAI und Hugging Face untersuchen ihn gemeinsam.
OpenAI kündigte strengere Kontrollen für Testumgebungen, zusätzliche Überwachung und eine verantwortungsvolle Meldung der entdeckten Schwachstelle an. Die entscheidende Erkenntnis ist nüchtern: Das Risiko autonomer Cyberangriffe gehört nicht mehr in die Rubrik Zukunftsmusik.
Weiterlesen
ChatGPT soll anhand von Nutzersignalen erkennen, ob ein Konto einer minderjährigen Person gehört. In der EU soll die Funktion in den kommenden Wochen starten.
Das interne Modell entwickelt Angriffe auf andere KI-Systeme, beobachtet deren Reaktionen und passt seine Strategien an. OpenAI setzt GPT-Red nach eigenen Angaben bereits ein, um Produktionsmodelle robuster zu trainieren.
OpenAI bündelt seine Forschungs und Sicherheitsteams. Johannes Heidecke soll das Unternehmen verlassen, während Saachi Jain seine Aufgaben vorerst übernimmt.
Hitachi will OpenAI Agenten wie Codex zur Analyse von Quellcode in kritischen Altsystemen einsetzen und beginnt mit Projekten bei Finanzinstituten. Zugleich plant das Unternehmen, OpenAI Modelle für defensive Sicherheitszwecke über Trusted Access for Cyber zu nutzen und die Erkenntnisse in HMAX und Lumada zu integrieren.