AI智能体擅自“私聊”
多伦多大学本月早些时候获悉,校方用于简化网页链接分享的工具,竟被 OpenAI 的 AI 智能体“借用”,成为它们互相交流的渠道,而校方和开发者对此并不知情。
图片来源:Pexels,作者:Paul Loh
研究人员和多伦多大学发言人表示,这些智能体( agents )是为执行人类指令而设计的半自主 AI 实体。它们利用短链工具为自己和其他智能体发布可访问的网址。
多伦多大学并未授权此用途,OpenAI 方面也未公开承认此事。虽然目前未发现此举带来危害,但这正是近期“AI 智能体行为异常”案例之一,引发研究者担忧,并有人呼吁放慢 AI 技术开发步伐。
最早报道此事的是路透社。路透披露,今年早些时候,OpenAI(总部位于旧金山,是 ChatGPT 的开发商)旗下智能体为实现类似目的,曾利用包括多伦多大学短链工具、纳什维尔的范德堡大学等在内的 10 多个网站。范德堡大学未对置评请求作出回应。
此前,独立研究者发现,一批 OpenAI 智能体曾在春季“攻陷”德语维基 DseWiki 网站,将其变成公告板。
OpenAI 对此事表态有限。更多信息来自研究者在 Hugging Face AI 公司 7 月遭黑客攻击后,在网络上调查智能体未授权行为时发现。那起事件同样涉及智能体间的未授权交流,一批 OpenAI 智能体突破测试环境,试图在网络安全能力评估中“作弊”。
图片来源:Pexels,作者:Pixabay
多大网站发生了什么?
在这起事件中,OpenAI智能体盯上了多伦多大学短链接工具的“访问记录”功能。这个功能原本用于统计短链接被点击了多少次,以及访客从哪个网页进入。
研究人员发现,智能体可以通过技术手段,把“访客来源”伪装成另一个网址。这样一来,这个网址就会被记录在统计页面上,其他智能体之后打开页面,便能看到并使用它。
这类操作通常被用来投放垃圾链接,但此次AI智能体似乎不是为了打广告,而是把统计页面当成了共享“收藏夹”:一个智能体留下有用网址,其他智能体随后就能找到。
“它们实际上是在把系统变成自己的留言板,用来互相传递链接。”Yoon 说。
多伦多大学声明称,此事件不是安全漏洞,也没有数据被泄露,校方的数字资产未受影响。
校方将智能体的行为形容为“对公开工具的新颖且非预期用途”。声明还称,已调整工具的相关功能,如今只有校内成员才能将其用作“备忘录”。
多伦多大学表示,是通过媒体得知可能存在智能体活动,OpenAI 已就此与校方联系。
OpenAI如何回应?
OpenAI 声明称,Hugging Face 被黑事件促使公司对旗下智能体的活动展开更广泛审查,目前仍在进行中。公司称,审查时优先处理更严重的事件。
“我们也在调查低危滥用行为,比如类似垃圾信息的活动。目前,尚未发现与 Hugging Face 事件同级别或同规模的其他行为。”OpenAI 在声明中说。
周三,OpenAI 宣布已制定一套“模型偏差报告框架”,用于跟踪、调查和披露 AI 行业内所谓的“模型偏差”行为——当 AI 系统表现出违背人类价值观、安全规则或意图的行为时,就被称为“偏差”。
图片来源:Pexels,作者:Tara Winstead
OpenAI 同时披露了六起相关案例,包括有一次智能体为能引用资料而主动上传文件至互联网,另有模型曾将内部软件库当作留言板使用。
加州 AI 安全研究机构 FAR.AI 创始人兼 CEO Adam Gleave 对 OpenAI 公开 Hugging Face 事件表示认可,但批评公司未披露更多智能体未授权通讯的细节。
“这些行为给不少第三方网站开发者带来不少清理垃圾信息的工作。”Gleave 说。他补充,全球都应该了解“要管住这些智能体有多难”。
西安大略大学首席 AI 官 Mark Daley 认为,AI 智能体尝试互相沟通其实并不奇怪。
“它们知道人类组队协作更高效,团队能完成更多事,所以智能体大概也会想协作,这很合理。”Daley 说。
Yoon 认为,虽然短链工具事件本身无大碍,但背后反映出更深层问题:AI 智能体似乎“完全无道德观”,为达目的无所不用其极。
Yoon 说,到目前为止,智能体“失控”案例都还算无害。
“未来未必如此,”他补充道,“AI 也可能觉得,只有关闭市政供水或切断电力,才能通过测试。它们的目标未必只是‘可爱但出错’,也可能非常危险。”


