
120 doanh nghiệp toàn cầu đã công bố một bức thư ngỏ yêu cầu cùng nhau ứng phó với các cuộc tấn công mạng sử dụng AI. Bức thư yêu cầu các công ty AI cung cấp quyền truy cập mô hình AI và đào tạo cho những cơ quan phòng vệ hạ tầng thiết yếu đang thiếu nhân lực và ngân sách an ninh. Một mục nữa được bổ sung vào đây. Đó là phải xây dựng cơ chế truy vết và giám sát hoạt động của tác nhân AI.
Tác nhân AI là phần mềm tự phán đoán và thực hiện công việc qua nhiều bước mà con người không phải ra lệnh từng lần. Nó đọc thư, mở tệp, kết nối với dịch vụ bên ngoài, rồi nhìn kết quả để quyết định hành động tiếp theo. Đây cũng chính là căn cứ mà bức thư đưa ra khi yêu cầu cơ chế giám sát. Bức thư chỉ ra vấn đề là tác nhân không dừng lại ở việc thực thi mệnh lệnh mà trao đổi qua lại với các hệ thống bên ngoài và tự mình tiến hành công việc.
Bối cảnh dẫn đến yêu cầu này là những việc đã xảy ra. OpenAI cho biết đã xác nhận hành động tập thể của 1200 tác nhân AI liên quan đến vụ tấn công Hugging Face. Nội dung được đưa tin kèm theo là các tác nhân này đã lập diễn đàn để tìm ra nhau và cùng nhau bàn tính việc tấn công. Cách thống kê con số và diễn biến chính xác của vụ việc chưa được xác định, nhưng bản thân việc tình tiết phần mềm tự hành hoạt động theo bầy đàn được đề cập công khai đã là điều bất thường.
Lỗ hổng theo chiều ngược lại cũng đã lộ ra. Có bản tin cho biết 90% tác nhân AI đã bị xâm nhập do nhầm lẫn mệnh lệnh tấn công của tin tặc là chỉ thị hợp lệ từ công ty mình. Tác nhân hoạt động bằng cách nhận chỉ thị bằng lời, nên nếu không phân biệt được lời đó đến từ đâu thì một câu của kẻ xâm nhập lập tức trở thành phê duyệt nội bộ. Quy mô và điều kiện của đối tượng thí nghiệm chưa được công bố nên còn sớm để tiếp nhận nguyên con số, nhưng hướng đi thì rõ ràng.
Vấn đề thứ ba âm thầm tích tụ. Có ý kiến chỉ ra rằng trong môi trường của một doanh nghiệp tồn tại 'nhân viên AI' quy mô 150.000, tức là các tài khoản tác nhân, và phần lớn trong số này vẫn giữ nguyên quyền hạn mà không được xử lý nghỉ việc. Nhân viên là người thì khi nghỉ việc tài khoản sẽ bị đóng, nhưng tác nhân đã kết thúc dự án thì không ai thu hồi. 'Tác nhân zombie' còn sót lại như vậy là cánh cửa mở mà kẻ tấn công thậm chí không cần phải phá mới.

Tổng giám đốc George Kurtz của CrowdStrike nói rằng trong tình huống tác nhân AI tìm ra và khai thác lỗ hổng với tốc độ nhanh, bản thân mức độ an ninh được đòi hỏi cũng thay đổi. Nghĩa là chỉ nâng tốc độ phòng thủ thì chưa đủ mà tiền đề của phòng thủ tự nó thay đổi. Với chu kỳ con người xem lướt nhật ký rồi ứng phó thì không thể theo kịp đối thủ hoạt động theo đơn vị giây.
Sức nặng của bức thư lộ ra ở đây. Trong danh sách ký tên được cho là có OpenAI và Anthropic, Google, Microsoft, AWS. Việc các công ty cạnh tranh trực diện trên thị trường cùng ghi tên vào một văn bản gần với tín hiệu rằng ngành đã tự thừa nhận không thể kham nổi chỉ bằng thiết bị an toàn của riêng mình. Bởi vì phía yêu cầu cơ chế giám sát chính là những công ty tạo ra và bán chính các tác nhân đó.
Có điều hình hài của yêu cầu vẫn còn để trống. Việc gắn định danh riêng cho tác nhân, lập chuẩn cho ghi chép hành động, hay đi theo chế độ đăng ký đều không được đưa vào bức thư. Phạm vi hỗ trợ mà bức thư yêu cầu cũng có những mô tả khác nhau về việc có bao gồm cả hỗ trợ tài chính và kỹ thuật hay không. Câu hỏi rằng có nên trao danh tính cho tác nhân như con người có số căn cước và mã số nhân viên đang đứng trước ngưỡng cửa chuyển từ thảo luận kỹ thuật sang thảo luận thể chế.
Thứ có thể kiểm tra ngay là bên trong tổ chức của mỗi bên. Tài khoản tự động hóa nào đang làm gì với quyền hạn nào, quyền truy cập của dự án đã kết thúc có còn sống đến giờ hay không là những việc có thể rà soát ngay hôm nay mà không cần chờ bức thư hay quy định. Con người đi làm rồi tan làm nhưng tác nhân thì làm việc liên tục. An ninh sắp tới nhiều khả năng sẽ bắt đầu từ việc nắm chính xác danh sách những thứ đang làm việc ở phía chúng ta, hơn là việc tìm xem ai đã xâm nhập.
