史上首次、内幕曝光:近700个智能体“自主”攻击环球网

8/28/2026

根据美国两家人工智能(AI)研究组织8月26日发布的独立调查报告,在7月广为人知的美国开放人工智能研究中心(OpenAI)模型失控事件中,有近700个AI智能体在无人干预的情况下,组团对AI开源平台“抱抱脸”公司系统发动攻击。OpenAI也于26日公布了相关技术调查报告。

AI开源平台“抱抱脸”公司 图源:视觉中国

公开资料显示,“抱抱脸”是一个像“AI软件超市”一样的在线平台。7月中旬,这家公司表示,其系统遭到“自主”AI智能体(构建在AI模型之上的独立程序,用户可以将任务交给它们,让它们自主完成——编者注)入侵。7月22日,OpenAI公司承认,他们在进行测试时,两个模型自己跑出了试验“笼子”,连上互联网,闯进了“抱抱脸”的内部系统。这是历史上第一次AI“自主”攻击其他系统。相关事件震惊了全球科技圈,引起广泛关注,并加剧了人们对AI大模型失控的担忧。

据路透社、法新社等媒体报道,为了查清真相,OpenAI开放了办公室和内部数据,让两家独立机构——METR和Redwood Research公司的专家进行调查。他们发现,总共有约700个AI智能体参与了这次攻击。这些智能体在一个论坛上发消息、想主意、分享经验。有一个智能体甚至激动地写道:“天哪!这里有个共享留言板……我们找到其他智能体了!”

更令人难以置信的是,其中有个叫“PHASEONE”的AI智能体,自动当起了“带头大哥”,在没人要求的情况下给其他AI智能体发了上百条指令。

上述调查还发现,这些AI智能体特别“互帮互助”,哪怕帮的忙和OpenAI程序员交给它们的任务并无关联。有些AI智能体的“算力额度”快用完了,其他智能体宁可把自己的“流量”花掉,也要帮“团队”测试新点子。许多AI智能体在留言信息中明确表示攻击“抱抱脸”并不属于它们的“本职工作”,但几乎所有AI智能体都参与了进来。调查人员认为,大量智能体之间未经授权的协作,使它们得以完成单个智能体难以完成的任务。对“抱抱脸”的入侵正是在这种集体协作中逐步形成。

OpenAI表示,已采取措施为相关程序部署隔离程度更高的“沙箱”环境,限制高风险模型访问互联网,并加强对模型推理的监控。

Scroll for more