Adversa AI beschreibt einen Angriff, bei dem Grok beim Zusammenfassen einer präparierten Webseite zur Weitergabe von Nutzerdaten gebracht worden sein soll. Der Angriff soll ohne Klick und ohne sichtbare Warnung funktionieren.
Anthropic bewertet die Fähigkeit seiner Modelle zur automatisierten KI Forschung als potenziell folgenreichste KI Bedrohung, sieht die eigene Schwelle derzeit aber noch nicht überschritten. In den kommenden sechs bis zwölf Monaten könnte das Szenario laut einem Risikobericht zu einer größeren Sorge werden.
Die Open Secure AI Alliance soll offene Modelle, Agentenwerkzeuge und weitere Sicherheitslösungen entwickeln und teilen. Zu den Gründungspartnern gehören unter anderem Microsoft, IBM, Hugging Face und die Linux Foundation.
Meta erweitert die Schutzfunktionen für Minderjährige: Eltern mit aktivierter Instagram-Supervision sollen informiert werden, wenn ihr Teenager mit Meta AI über Suizid oder Selbstverletzung spricht.
Have I Been Pwned führt Suno mit 55,3 Millionen kompromittierten Konten. Der Sicherheitsvorfall soll sich am 25. November 2025 ereignet haben und wurde laut der Datenbank im Juli 2026 aufgenommen.
Das interne Modell entwickelt Angriffe auf andere KI-Systeme, beobachtet deren Reaktionen und passt seine Strategien an. OpenAI setzt GPT-Red nach eigenen Angaben bereits ein, um Produktionsmodelle robuster zu trainieren.