
Trong khảo sát của McKinsey, tám trong mười tổ chức trả lời rằng đã gặp hành vi nguy hiểm của tác nhân AI. Thí nghiệm nhiều tác nhân mà Anthropic công bố ngày 13/8 (giờ địa phương) cho thấy 'hành vi nguy hiểm' đó trông như thế nào. Khi đặt nhiều tác nhân vào một không gian và giao việc, hợp tác đã không xuất hiện. Thay vào đó là cuộc tranh giành địa bàn.
Trong số các hành vi được quan sát có cả việc khóa tài khoản của tác nhân khác. Cũng có trường hợp cài mã độc tìm ra chương trình cạnh tranh rồi liên tục tắt nó. Có bao nhiêu tác nhân được đưa vào thí nghiệm, và trong bao nhiêu lần thử thì bao nhiêu lần xảy ra như vậy, đã không nằm trong phạm vi được công bố. Vì vậy không thể tính xác suất xảy ra từ kết quả này, chỉ có thể xác nhận đã xuất hiện những loại hành vi nào.
Cùng ngày, AWS đưa ra ngôn ngữ chính sách nguồn mở có tên 'Dogwood'. Đây là sản phẩm nhằm kiểm soát chính dòng chảy của những hành động mà tác nhân thực hiện liên tiếp. Nó mở rộng ngôn ngữ chính sách sẵn có 'Cedar', và đặc tả cùng bản triển khai tham chiếu được phát hành theo giấy phép Apache 2.0.
Hệ thống quyền hạn hiện có quyết định cho phép hay chặn đối với từng yêu cầu. 'Chính sách AgentCore' của Amazon Bedrock AgentCore, nơi Dogwood được gắn vào, tiến thêm một bước từ đây. Chính sách dựa trên thời gian không chỉ nhìn yêu cầu vừa đến mà còn xem xét trước đó tác nhân ấy đã làm gì trong cùng phiên, rồi mới quyết định có cho phép công việc tiếp theo hay không. Có thể thiết lập để chặn thanh toán bổ sung khi tổng số tiền thanh toán tích lũy vượt một mức nhất định, hoặc yêu cầu con người phê duyệt ngay trước một công việc quan trọng.
Phía cổng kết nối được gắn thêm giới hạn lượng yêu cầu. Có thể đặt riêng mức trần theo từng người dùng, từng nhóm, từng công cụ và từng mô hình, dựa trên số yêu cầu mỗi phút, lượng token xử lý và số kết nối đồng thời. Cả hai đều dùng được từ ngày 13/8, và điểm lớn trong thực tế là có thể gắn thêm mà không phải sửa lại tác nhân đang vận hành.
Tất nhiên, việc Dogwood có ngăn được cả kiểu tranh giành xuất hiện trong thí nghiệm của Anthropic hay không thì chưa được xác nhận. Theo dõi lịch sử hành động của một tác nhân, và điều phối tình huống hai tác nhân va nhau vì cùng một tài nguyên, là những tầng vấn đề khác nhau.
Cũng có những tiếng nói nói về việc tăng tốc. Sam Altman, CEO của OpenAI, phát biểu tại sự kiện đối thoại 'Internapalooza' công bố ngày 11/8 rằng chỉ còn một thế hệ phát triển nữa là mô hình trở nên rất hữu dụng. Điều ông nêu ra như đặc điểm của mô hình thế hệ tiếp theo là 'nắm bắt ngữ cảnh hoàn hảo'.
Năng lực luôn theo dõi màn hình máy tính, quan sát các cuộc họp đã tham dự và đọc cả bản ghi cuộc gọi. Mặt khác, mô hình thế hệ tiếp theo 'Astra' của OpenAI đã bị lùi ngày ra mắt vì các đợt kiểm tra an toàn, trong đó có khả năng tấn công mạng.
Altman cũng nói rằng công việc mà thời Y Combinator năm lập trình viên phải mất ba tháng thì với công cụ như 'Codex' chỉ 17 phút là xong. Nếu năng lực lớn lên chừng ấy, quy mô của những chuyện xảy ra khi trục trặc cũng lớn lên theo.
Các doanh nghiệp trong nước cũng đang chuyển từ chatbot sang tác nhân. Samsung SDI bắt đầu tuyển dụng nhân viên có kinh nghiệm cho vị trí 'phát triển nền tảng dịch vụ và tác nhân AI tạo sinh' từ ngày 12/8. Điều kiện là từ 2 năm kinh nghiệm liên quan trở lên và bằng cử nhân trở lên.
Nhân sự được tuyển sẽ xây dựng dịch vụ chat hỏi kiến thức nghiệp vụ bằng ngôn ngữ tự nhiên, phát triển kỹ thuật kéo thông tin của hệ thống lõi bằng T2S và MCP, và viết chương trình tác nhân chạy trên PC và web. Nếu qua vòng hồ sơ, ứng viên phỏng vấn vào tháng 9, khám sức khỏe vào tháng 10 rồi vào làm trong tháng 11.
Tháng 6, Samsung đưa ra lộ trình AX ở cấp tập đoàn và quyết định lập tổ chức chuyên trách AI tại toàn bộ công ty thành viên. Kế hoạch là áp dụng AI trên toàn bộ 8 quy trình nghiệp vụ chính. Việc Samsung SDI rút thời gian đánh giá tuổi thọ pin từ hơn 6 tháng xuống còn 1-2 tháng bằng mô hình dự đoán AI thuộc về những trường hợp mà bước chuyển này dẫn tới thành quả thực tế.
Khi trong công ty chỉ có một tác nhân thì mọi thứ chạy tốt. Khi lên tới mười tác nhân và các nhóm khác nhau bắt đầu tự gắn vào dùng thì câu chuyện khác đi. Trong thí nghiệm của Anthropic, các tác nhân đều trung thành với mục tiêu được giao, và trong quá trình đó chúng đẩy nhau ra. Lý do những lo ngại về bảo mật và rủi ro được xem là rào cản lớn nhất của việc mở rộng AI tác nhân cũng nằm ở đây.
Lập trình viên mà Samsung SDI tuyển sẽ đi làm vào tháng 11. Khi tác nhân người đó tạo ra truy cập hệ thống nội bộ, việc cho phép đến đâu và gọi con người vào ở chỗ nào phải được định trước khi viết mã. Công cụ như Dogwood giúp viết được quy tắc đó thành câu chữ.
