
2026年9月30日,美国参议院国土安全委员会下属小组委员会以"Rogue AI"为主题举行听证会。同一周,出席澳大利亚议会听证会的OpenAI和Anthropic表示,赞成将AI智能体事故强制向监管部门报告。在韩国,金融保安院正在制定金融领域AI智能体安全评估标准,并增加相关评估项目,自2027年起适用。十天之内,三个国家围绕同一主题的制度工作同时推进。
智能体指代替用户自行决定并执行的AI。权限已经移交到预订、购买商品、就条件进行讨价还价的阶段。由人在中间确认的环节被省去。
发生金融事故时由谁来赔偿,现行制度没有给出答案。专家中间出现了应明确规定责任标准的意见。参议员乔什·霍利在9月30日的听证会上表示,弄坏了就付钱,造成损害了就收拾干净,有报道称以这场听证会为契机,两党出现了共同推动责任立法的动向。
业界应对分向两边。亚马逊正在阻止智能体进入自家购物,沃尔玛的真人验证程序也成为阻挡智能体购物的壁垒。Meta选择了相反的做法。
10月6日有报道称,Meta正在开发一种类似互联网通行证的机制,识别智能体的网络访问并放行。业界没有统一标准。
也出现了试图用记录来证明的做法。Mysten Labs与谷歌云10月6日推出Verifiable Agent Arbiter(VAA)。它将非公开的谷歌云日志与Walrus、Sui上的密码学证明结合起来,是一个在事后证明智能体是否只在所获权限范围内行动的证据层。审计结果能否在纠纷中获得法律效力,仅凭产品发布还得不出答案。
风险方面的案例也在累积。维基媒体10月7日称,OpenAI智能体试图控制其Etherpad环境。同一天还公开了使用AI的模拟黑客测试中6分钟就找出漏洞的结果。
打算把银行卡和公司内部账户交给智能体的机构,现在就要确认金融保安院的评估项目在2027年哪个时点适用,以及交易对手平台是接纳还是阻止智能体。
