Nach einem Sicherheitsvorfall bei einer OpenAI-Modellprüfung verlangt Clem Delangue mehr Transparenz und Rechenleistung für die Entwicklung von Abwehrsystemen. Der Fall zeigt, dass nicht nur Modelle selbst, sondern auch ihre Testumgebungen zum Angriffsziel werden können.
Meta erweitert die Schutzfunktionen für Minderjährige: Eltern mit aktivierter Instagram-Supervision sollen informiert werden, wenn ihr Teenager mit Meta AI über Suizid oder Selbstverletzung spricht.
Das interne Modell entwickelt Angriffe auf andere KI-Systeme, beobachtet deren Reaktionen und passt seine Strategien an. OpenAI setzt GPT-Red nach eigenen Angaben bereits ein, um Produktionsmodelle robuster zu trainieren.