OpenAI发现更多AI失控案HK01

7/31/2026

路透社8月1日引用知情人士消息报道,OpenAI在调查智慧体失控入侵科技公司Hugging Face事件时,发现了数宗其他AI代理突破封闭测试环境、脱离管控的桉例。

报道指,OpenAI正联合外部专家複盘今年早期日志,核查事件细节。OpenAI发言人周二表曾示,公司正在检视旗下模型「更广泛的活动」,范围不仅限于Hugging Face遭入侵一桉。

(reddit@Dakhil)

此次调查碰上竞争对手Anthropic曝光安全事故,公司模型自四月起多次引发资料洩露,致三家公司受损。

有专家指出,相关开发人员的水准「并没有跟上步伐」,无法负责任地确保AI发展的安全。OpenAI和Anthropic未有效即时监测失控智慧体,安全审查机制存在明显漏洞。

美国总统特朗普(Donald Trump,又译川普)周四(7月30日)表示正在研究管控措施;欧盟委员会周五表示已与OpenAI和Anthropic进行会谈。同时,业界也呼吁针对先进AI模型落地强制性能力测试,完善行业监管规范。

路透社指,目前还不确定OpenAI究竟查出多少宗事件,也无法确认这些事件发生的确切时间或情况。

Scroll for more