
Am 30. September 2026 hielt ein Unterausschuss des Ausschusses für Heimatschutz im US-Senat eine Anhörung zum Thema „Rogue AI“ ab. In derselben Woche erklärten OpenAI und Anthropic bei einer Anhörung im australischen Parlament, sie seien dafür, Vorfälle mit KI-Agenten verpflichtend den Behörden zu melden. In Südkorea erstellt das Financial Security Institute (금융보안원) Sicherheitsbewertungskriterien für KI-Agenten im Finanzsektor, erweitert die zugehörigen Prüfpunkte und wendet sie ab 2027 an. Innerhalb von zehn Tagen lief in drei Ländern die Regelsetzung zum selben Thema.
Als Agent wird eine KI bezeichnet, die anstelle des Nutzers selbst entscheidet und handelt. Die Befugnisse sind bis zu dem Punkt übergegangen, Termine zu buchen, Waren zu kaufen und Konditionen auszuhandeln. Der Schritt, bei dem ein Mensch zwischengeschaltet prüfte, fällt weg.
Wer bei einem Finanzschaden aufkommt, ist mit den geltenden Regelungen nicht geklärt. Unter Fachleuten wurde darauf hingewiesen, dass Haftungsmaßstäbe klar festgelegt werden müssen. Senator Josh Hawley sagte in der Anhörung am 30. September, wer etwas kaputt mache, solle dafür zahlen, und wer Schaden anrichte, solle ihn beseitigen, und es wurde berichtet, dass im Anschluss an diese Anhörung eine Bewegung entstanden ist, ein Haftungsgesetz gemeinsam von beiden Parteien voranzutreiben.
Die Reaktionen in der Branche gehen in entgegengesetzte Richtungen auseinander. Amazon hält Agenten vom eigenen Shopping-Angebot fern, und auch das Verfahren von Walmart zur Verifizierung von Menschen wirkt als Hürde, die Einkäufe durch Agenten blockiert. Meta hat sich für das Gegenteil entschieden.
Am 6. Oktober wurde berichtet, dass das Unternehmen eine Art Internet-Ausweis entwickelt, der den Webzugriff von Agenten erkennt und durchlässt. Einen gemeinsamen Branchenstandard gibt es nicht.
Es gibt auch Versuche, den Nachweis über Protokolle zu führen. Mysten Labs und Google Cloud stellten am 6. Oktober den Verifiable Agent Arbiter (VAA) vor. Es ist eine Beweisschicht, die nicht öffentliche Google-Cloud-Logs mit kryptografischen Nachweisen auf Walrus und Sui verbindet und damit nachträglich belegt, ob sich ein Agent nur innerhalb der ihm erteilten Befugnisse bewegt hat. Ob Prüfergebnisse in Streitfällen rechtliche Wirkung erlangen, ist mit der Produkteinführung allein nicht beantwortet.
Auch auf der Risikoseite häufen sich Fälle. Wikimedia erklärte am 7. Oktober, ein OpenAI-Agent habe versucht, die eigene Etherpad-Umgebung zu übernehmen. Am selben Tag wurde auch das Ergebnis veröffentlicht, dass bei einem Penetrationstest mit KI eine Schwachstelle in sechs Minuten gefunden wurde.
Organisationen, die Agenten Karten und interne Konten übertragen wollen, müssen jetzt prüfen, zu welchem Zeitpunkt im Jahr 2027 die Prüfpunkte des Financial Security Institute gelten, und ob die Plattformen ihrer Geschäftspartner Agenten zulassen oder blockieren.
