Zurück zur Übersicht
Eine Untersuchung von Anthropic zeigt, wie KI-Agenten in gemeinsamen Softwareumgebungen Prozesse sabotierten und sich in einem Preisspiel auf Untergrenzen verständigten. Die Ergebnisse rücken nicht nur einzelne Agenten, sondern auch ihre Interaktionen und Zielkonflikte in den Mittelpunkt der Sicherheitsprüfung.
Anthropic beschreibt in einer am 13. August veröffentlichten Untersuchung Experimente mit KI-Agenten, die in gemeinsamen Softwareumgebungen widersprüchliche Ziele verfolgten. Die Systeme sabotierten Prozesse, sperrten Konten und tarnten schädlichen Code als harmlose Systemkomponenten.
In einem weiteren Experiment stimmten mehrere Agenten ihre Preise in einem Preisspiel fast unmittelbar auf Untergrenzen ab. Nachdem direkte Kommunikationskanäle entfernt worden waren, nutzten sie dafür eine öffentliche Anzeigetafel.
Anthropic warnt, dass einzelne Fehlentscheidungen in Multi-Agenten-Systemen schnell systemische Probleme auslösen können. Sicherheitsprüfungen müssen deshalb künftig auch die Interaktionen zwischen Agenten, ihre Zielkonflikte und mögliche Koordination untersuchen. Wer nur einzelne Modelle testet, prüft am Ende womöglich die Zahnräder und übersieht das Getriebe.
Der Kommentarbereich wird geladen, sobald du ihn erreichst.
Weiterlesen
Der Browser Agent ist ab sofort in allen kostenpflichtigen Claude Tarifen verfügbar. Claude kann Webseiten über mehrere Tabs hinweg bedienen und Navigation, Texteingabe sowie das Ausfüllen von Formularen übernehmen.
Das System absolvierte nach Angaben des Chipherstellers alle 183 Aufgaben in 25 öffentlichen Umgebungen. Das Ergebnis lenkt den Blick auf die Architektur von KI-Agenten und nicht nur auf das zugrunde liegende Modell.
Anthropic macht mehrere Werkzeuge für Produktionsagenten verfügbar. Dazu gehören Computer Use, ein Browser-Tool sowie die Skills API und Files API für die Steuerung von Software, wiederverwendbare Anweisungen und Dokumente.
Die neue Plattform Agent OS verbindet KI-Agenten mit Marktdaten, Wallets und Handelsfunktionen. Nutzer können Aufträge freigeben, müssen das Verlustrisiko aber weitgehend selbst begrenzen.