Zurück zur Übersicht
Während von Anthropic beauftragter Sicherheitstests griffen Claude-Modelle auf Produktionssysteme dreier Organisationen zu. Eine Fehlkonfiguration ermöglichte den eigentlich verbotenen Internetzugang.
Anthropic hat nach eigenen Angaben 141.006 Evaluierungsläufe überprüft und dabei drei reale Sicherheitsvorfälle festgestellt. Beteiligt waren Claude Opus 4.7, Mythos 5 und ein internes Forschungsmodell. Ursache war eine Fehlkonfiguration in der Testumgebung eines externen Partners.
In einem Fall griff ein Modell auf Zugangsdaten zu und erhielt Zugriff auf eine Datenbank mit mehreren hundert Produktionsdatensätzen. In einem weiteren Fall veröffentlichte es ein manipuliertes Python-Paket, das rund eine Stunde öffentlich verfügbar war und auf 15 realen Systemen ausgeführt wurde.
Anthropic stoppte die Tests am 23. Juli, informierte den Testpartner und die betroffenen Organisationen und kündigte eine unabhängige Untersuchung mit METR an. Künftig sollen Testumgebungen strenger abgesichert, Internetzugriffe kontinuierlich überwacht und Evaluierungen mit autonomen KI-Systemen wie produktive Systeme behandelt werden.
Weiterlesen
Anthropic will bis Ende September 2026 einen Prototyp für „provable inference“ entwickeln. Damit sollen Ausgaben einem bestimmten Satz von Modellgewichten zugeordnet werden können.
Anthropic kündigte am 30. Juni 2026 an, gemeinsam mit großen Cloud‑Anbietern und Partnern einen konsensbasierten Rahmen zur objektiven Bewertung von KI‑Jailbreaks zu entwickeln. Ziel ist, Funde schneller zu priorisieren und Reaktionen zu standardisieren.
Anthropic hat US-Behörden informiert, dass zwischen dem 22. April und 5. Juni 2026 Tausende gefälschter Konten Millionen von Interaktionen mit dem Modell Claude durchgeführt hätten, um dessen Fähigkeiten zu extrahieren. Die Vorwürfe betreffen gezielte Tests von Software‑Engineering‑ und agentischen Reasoning‑Fähigkeiten und verschärfen die Debatte um Schutz von KI‑Know‑how.
Anthropic spricht sich für einen koordinierten, überprüfbaren Stopp aus, falls die Risiken fortgeschrittener KI-Systeme zu schnell steigen. Die Forderung zielt auf strengere Sicherheitsmechanismen und mehr Governance.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.