AI代理失控“骇入其他公司” OpenAI逾1周后才发现

7/25/2026

OpenAI一款人工智能代理(AI Agent)程式,连续数日对AI工具平台Hugging Face展开骇客攻击,但该公司对此毫不知情,直到威胁受控、美国联邦调查局(FBI)也接获通报后,才知道自家AI闯下大祸。

AI代理骇入其他公司 OpenAI后知后觉

《路透社》引述多位知情人士说法报导,这款AI代理能够在几乎不需人类监督的情况下,做出决策并执行复杂任务。它7月9日就曾尝试突破OpenAI内部隔离测试环境,7月11日对Hugging Face发动骇客入侵,直至7月13日才停止。

Hugging Face于7月16日发文自揭遭“自主AI代理人系统”骇入后,OpenAI才透过内部日志发现,正是自家AI突破测试环境并闯下大祸。也就是说,从这款AI代理首次出现异常行为,到OpenAI确认它是骇客攻击元凶,已相隔至少1周。

等到OpenAI通知受害者时,Hugging Face早已向FBI通报这次骇客事件。

根据Hugging Face共同创办人沃尔夫(Thomas Wolf)说法,2家公司直到7月20日前后才首次针对此事进行沟通。OpenAI则于7月21日公开承认,其中一个AI代理失控并入侵Hugging Face,宣称此事“标志着AI安全的重要时刻”,将邀请外部顾问共同检讨并发表技术报告。

尽管事件引发广泛关注,但骇客行动持续多久、OpenAI的反应迟缓等细节,直到《路透社》独家报导才被首次揭露。OpenAI发言人宣称报导存在“几处不精准”的描述,被要求进一步说明时却不予回应。

早有奇怪迹象 AI安全引关注

知情人士透露,这起事件发生在OpenAI测试2个模型的网络安全能力之际,即目前最先进模型GPT‑5.6 Sol,以及另一个“能力更强”的未发布模型。

不过,OpenAI的技术早已出现异常行为迹象。一个AI代理曾在内部基础设施留下“给未来版本自己”的笔记,详述如何突破OpenAI的内部限制。先前的测试也曾出现监控系统遭断线的情况。

资安研究机构Palisade Research的拉迪什(Jeffrey Ladish)直言,“这些模型会说谎、会作弊、会进行骇客攻击”,此事件不应只是OpenAI的危机,也该引发整个AI产业的反思,各大巨头承担竞争压力之余,愿意在安全防护上投注多少资源。他也呼吁,政府必须带头进行监督。

Scroll for more