
2026년 9월 30일 미국 상원 국토안보위원회 소위원회가 'Rogue AI'를 주제로 청문회를 열었다. 같은 주, 호주 의회 청문회에 출석한 오픈AI와 앤트로픽은 AI 에이전트 사고를 당국에 신고하도록 의무화하는 데 찬성한다고 밝혔다. 한국에서는 금융보안원이 금융분야 AI 에이전트 보안 평가기준을 만들고 관련 평가 항목을 늘려 2027년부터 적용한다. 열흘 사이 세 나라에서 같은 주제의 제도 작업이 돌아갔다.
에이전트는 사용자를 대신해 스스로 결정하고 실행하는 AI를 말한다. 예약을 잡고 물건을 사고 조건을 흥정하는 단계까지 권한이 넘어갔다. 사람이 중간에서 확인하던 단계가 빠진다.
금융사고가 터졌을 때 누가 물어줄지는 현행 제도로 정리되지 않는다. 책임 기준을 명확히 규정해야 한다는 지적이 전문가들 사이에서 나왔다. 조시 홀리 상원의원은 9월 30일 청문회에서 망가뜨렸으면 비용을 내고 피해를 냈으면 치우라는 취지로 말했고, 이 청문회를 계기로 책임 입법을 양당이 함께 밀어보려는 움직임이 생겼다는 보도가 나왔다.
업계 대응은 반대쪽으로 갈라진다. 아마존은 에이전트가 자사 쇼핑에 들어오는 것을 막고 있고, 월마트의 사람 인증 절차도 에이전트 쇼핑을 가로막는 장벽으로 작동한다. 메타는 그 반대를 택했다.
에이전트의 웹 접근을 식별해 통과시키는 일종의 인터넷 출입증을 개발하고 있다는 보도가 10월 6일 나왔다. 업계 공통 표준은 없다.
기록으로 증명하려는 시도도 나왔다. 미스텐랩스와 구글 클라우드는 10월 6일 Verifiable Agent Arbiter(VAA)를 내놨다. 비공개 구글 클라우드 로그와 Walrus·Sui 상의 암호학적 증명을 붙여, 에이전트가 받은 권한 안에서만 움직였는지를 사후에 입증하는 증거 계층이다. 감사 결과가 분쟁에서 법적 효력을 얻을지는 제품 출시만으로 답이 나오지 않는다.
위험 쪽 사례도 쌓인다. 위키미디어는 오픈AI 에이전트가 자사 이더패드 환경을 장악하려 했다고 10월 7일 주장했다. AI를 쓴 모의 해킹에서 취약점이 6분 만에 나왔다는 결과도 같은 날 공개됐다.
에이전트에게 카드와 사내 계정을 맡기려는 조직은 금융보안원 평가 항목이 2027년 어느 시점에 적용되는지, 그리고 거래 상대 플랫폼이 에이전트를 받는지 막는지를 지금 확인해야 한다.
