
Ngày 30/9/2026, một tiểu ban thuộc Ủy ban An ninh Nội địa Thượng viện Mỹ đã mở phiên điều trần với chủ đề 'Rogue AI'. Cùng tuần đó, OpenAI và Anthropic khi tham dự phiên điều trần của Quốc hội Úc cho biết họ ủng hộ việc bắt buộc báo cáo các sự cố của tác nhân AI cho cơ quan chức năng. Tại Hàn Quốc, Viện An ninh Tài chính (금융보안원) xây dựng tiêu chuẩn đánh giá an ninh cho tác nhân AI trong lĩnh vực tài chính và tăng các hạng mục đánh giá liên quan, áp dụng từ năm 2027. Trong vòng mười ngày, công việc xây dựng thể chế về cùng một chủ đề đã diễn ra ở ba nước.
Tác nhân là AI tự quyết định và thực hiện thay cho người dùng. Quyền hạn đã được chuyển sang tới mức đặt chỗ, mua hàng và mặc cả điều kiện. Bước con người xác nhận ở giữa bị bỏ đi.
Khi xảy ra sự cố tài chính, ai sẽ đền bù là điều chưa được giải quyết bằng quy định hiện hành. Giới chuyên gia đã nêu ý kiến rằng cần quy định rõ tiêu chí trách nhiệm. Thượng nghị sĩ Josh Hawley phát biểu tại phiên điều trần ngày 30/9 với ý rằng đã làm hỏng thì phải trả tiền, đã gây thiệt hại thì phải dọn, và báo chí đưa tin rằng từ phiên điều trần này đã xuất hiện động thái hai đảng cùng thúc đẩy luật về trách nhiệm.
Phản ứng của giới doanh nghiệp chia theo hai hướng trái ngược. Amazon đang chặn tác nhân vào hoạt động mua sắm của mình, còn quy trình xác thực người thật của Walmart cũng hoạt động như một rào cản ngăn tác nhân mua sắm. Meta chọn hướng ngược lại.
Ngày 6/10 có tin công ty này đang phát triển một loại giấy thông hành internet, nhận diện và cho thông qua việc truy cập web của tác nhân. Không có tiêu chuẩn chung của ngành.
Cũng đã xuất hiện nỗ lực chứng minh bằng bản ghi. Mysten Labs và Google Cloud ngày 6/10 đã giới thiệu Verifiable Agent Arbiter (VAA). Đây là lớp bằng chứng gắn log Google Cloud không công khai với chứng minh mật mã trên Walrus và Sui, để chứng thực về sau rằng tác nhân chỉ hoạt động trong phạm vi quyền hạn được giao. Kết quả kiểm toán có được hiệu lực pháp lý trong tranh chấp hay không thì chỉ việc ra mắt sản phẩm chưa cho ra câu trả lời.
Các trường hợp về phía rủi ro cũng tích lại. Wikimedia ngày 7/10 nêu rằng tác nhân của OpenAI đã tìm cách chiếm quyền kiểm soát môi trường Etherpad của mình. Kết quả cho thấy trong một cuộc thử nghiệm xâm nhập dùng AI, lỗ hổng được tìm ra chỉ sau 6 phút cũng được công bố cùng ngày.
Các tổ chức muốn giao thẻ thanh toán và tài khoản nội bộ cho tác nhân cần kiểm tra ngay từ bây giờ các hạng mục đánh giá của Viện An ninh Tài chính được áp dụng vào thời điểm nào trong năm 2027, và nền tảng đối tác giao dịch tiếp nhận hay chặn tác nhân.
