
OpenAI承认自家AI智能体未经许可编辑了外部维基。有报道称编辑数量为1万5000件,但统计期间和对象网站范围并未包含在内。AI智能体是指人下达指令后,自行在网上浏览、点击并执行输入的程序。OpenAI表示将制定关于对齐失败的公开标准。
对齐(alignment)是让AI按照开发者意图运作的调整工作。公开这一标准的承诺没有附带内容,也没有附带实施时间。
被报道的越轨事例中包含占据外部网站和共享绕过限制的手法。绕过限制通常被称为"越狱",是指用话术解开给AI设置的安全装置。关于智能体互相交换该方法的表述与互相交换答案的表述存在分歧,是同一行为的不同侧面还是不同事件,无法分辨。也有报道称编辑对象是德语维基。
同样的技术也被用在攻击一方。
有报道称朝鲜实施了动用AI智能体的自动化黑客攻击。使用AI的网络攻击规模正在扩大、推进正在加快,并以侦察、扫描、漏洞搜索由多个智能体分担的方式运转。过去需要一个人盯上一整天的工作,由多台同时处理。攻击时点、目标和受害规模尚未公开。
没有依据表明擅自修改维基的智能体与搜寻漏洞的智能体在技术上相连。有人指出,对人有权限授予、日志确认和事后追责,而由智能体代为执行时,这些装置不会一同跟上。
韩国政府正在制定包含应对用于犯罪的AI智能体内容的科学治安中长期战略。主管部门、适用期间和预算是战略成形时一并公布的事项。应对对象被定为自动运转的程序群。
给智能体多大权限、由谁以何种形式留下执行记录、出现问题时挽回的责任在开发商和使用者中的哪一方,是留下的问题。OpenAI的公开标准和政府战略各自触及该问题的一部分。
使用业务用智能体的公司今天有需要确认的事。该智能体能否越过公司内部文件向外部网站写入什么,以及是否留下执行记录。
