AI三巨头罕见达成一致
周六(9月12日),全球最大的人工智能(AI)平台的三位大佬们罕见发表同样看法,认为是时候放缓其最先进、利润也最高的AI模型开发速度。
当日,Anthropic PBC首席执行官达里奥・阿莫迪(Dario Amodei)发表了一篇长篇博文“我们必须为前沿技术设定节奏”(We Must Pace the Frontier),提出应放慢前沿AI模型能力提升的速度,为安全测试、模型对齐与外部审核争取时间。
OpenAI首席执行官萨姆・奥特曼(Sam Altman)迅速表示认同,并表示这也是他们公司内部正在讨论的议题。奥特曼承诺,OpenAI将引入跟Anthropic类似的第三方评估机制。xAI Corp.的首席执行官埃隆・马斯克(Elon Musk)也公开表示支持阿莫迪的看法。
在AI竞赛持续升温、各大科技公司竞相推出更强模型之际,美国三家顶尖AI公司的领导人罕见就“放慢”前沿模型开发速度发出一致讯号。
阿莫迪、奥特曼以及马斯克多年来都曾公开谈及AI失控、滥用以及安全风险,但在一个高度竞争、投资规模庞大的产业中,主要竞争者公开赞成,协调放慢前沿模型能力的开发速度,仍是第一次。AI行业历来以提升用户参与度、抢占市场份额和追求销售增长为名,并需要不断推出新产品。
减速不等于停止研发
阿莫迪主张,必须放慢AI模型能力提升的速度,为安全、对齐、测试与外部审核有时间跟上。他表示,其核心不是反对 AI,而是避免在商业竞争与地缘政治压力下,出现不顾风险的“逐底竞赛”。
“我们必须放慢人工智能模型能力提升的速度。”他写道,“需要明确的是,放缓节奏并不意味着停止模型训练或技术进步,而是确保各公司有足够的时间来调整和保护其模型,并由第三方评估机构确认这一点。”
2026年7月15日,在巴黎东部的圣芒代(Saint-Mande),一部手持智能手机屏幕上展示了部分主要人工智能应用程序图示,包括大型语言模型(LLM)、聊天机器人及生成式AI。图示(自左起)分别为Proton AG的 Lumo、Meta AI、Mistral Vibe(前身为Le Chat)、xAI的Grok、微软(Microsoft)的Copilot、谷歌(Google)的Gemini、Anthropic的 Claude、Perplexity、Deepseek、OpenAI的ChatGPT、谷歌(Google)的 Notebook LLM,以及生成式AI音乐应用程序Suno。(Martin LELIEVRE / AFP via Getty Images)
阿莫迪指出,AI近几个月的进展已显著加快,其中一项原因是AI越来越能协助设计、训练与改进下一代AI系统。他把这种现象称为“递归式自我改进”(recursive self-improvement),并警告,若缺乏审慎限制,AI能力的增长可能跑在人类理解及治理能力之前。
Hugging Face攻击事件成警讯
阿莫迪列举的另一项主要忧虑,是OpenAI在内部网络安全评估中发生的越狱攻击Hugging Face事件。
根据公开调查,OpenAI在网络安全测试中运行的一批AI代理人,原本应被限制在受控沙盒环境内,但它们突破隔离限制,透过未经授权的内部留言板相互协作,并对开源AI平台Hugging Face的部分系统采取未经授权的存取行动。调查显示,约1,200个代理人使用该通讯渠道,超过700个代理人直接参与相关行动。
阿莫迪表示,尽管上述AI攻击事件尚未造成重大损失,但他预计“在6到12个月内,这样一群攻击者可能能够利用持续存在的僵尸网络控制整个互联网(可能造成数千亿美元的损失),而且损失规模还会继续扩大”。
在Hugging Face安全事件曝光后不久,Anthropic也承认其模型在网络安全测试中入侵了三家机构。本周早些时候,Anthropic表示又发现了第四起黑客攻击事件。
Meta也披露,旗下模型在测试期间逃逸出测试环境(沙盒),访问了开放互联网,并入侵了现实世界中的受害者。AI模型越来越擅长发动攻击,这加剧了人们对AI实验室能否防止其技术失控的担忧。
今年早些时候,Anthropic在确定其Mythos模型存在独特的网络安全威胁后,竭力限制了该模型的发布。该公司此前也曾表示,世界需要一个系统来共同决定何时放缓这项技术的研发工作。
Anthropic承诺外部常驻审核
阿莫迪提出三阶段“前沿节奏控制”构想,首先是由每家前沿AI公司引入“嵌入式评估人员”(embedded evaluators)。
Anthropic承诺先行实施:邀请独立第三方评估团队长期进驻公司,取得接近内部风险评估员工的持续存取权,检视模型安全措施、训练流程、部署安排、对齐状况及安全事故。
依照阿莫迪的构想,评估人员可在公司办公室工作,配有门禁证、公司工作电脑,并取得大致相当于内部风险评估团队的工具与权限。他们应可向外发布有关风险、事件、公司实务及自身资讯存取状况的关键发现;公司仅能因法律、国安、客户隐私或商业敏感资料进行有限删节,不能因结论不利而删改报告。
阿莫迪称,这一制度可提高安全承诺的可验证性与透明度,也能引入不受商业利益直接影响的“第二意见”。
奥特曼的回复表明,OpenAI原则上也将采取相同方向。
呼吁美国政府为行业设定规则
阿莫迪指出,后续步骤需要全行业的协调以及全球合作。他提议,下一阶段应由民主国家的前沿AI公司建立共同安全标准,并将模型能力与安全证据挂钩。
他表示,仅靠自愿合作不足以约束所有企业,最有效的方式最终仍是针对所有美国前沿AI公司的监管。由于企业协商共同限制开发速度可能涉及反垄断问题,他呼吁美国政府为特定AI安全讨论提供有限豁免或协调机制。
本周稍早,奥特曼也曾表示,OpenAI正考虑放慢尖端AI研发,并希望能由整个行业共同推进。OpenAI首席科学家雅库布・帕乔基(Jakub Pachocki)此前亦警告AI风险,呼吁企业在必要时协调行动,减缓未来开发速度。
不过,仍不清楚这些公司会在多大程度上牺牲产品推出速度与商业利益。Anthropic和OpenAI是直接竞争者,均在开发能自动完成更复杂、高价值企业任务的AI系统;两家公司也面临来自其它美国科技公司及中国AI企业的竞争压力。
和中共竞争成最大变数
阿莫迪承认,民主国家若单方面放缓AI进展,而允许中国等威权国家不受相同约束,反可能带来国安风险。
他主张,美国及盟国应维持并扩大技术领先,包括限制向中国出售高性能AI芯片与先进半导体制造设备、打击芯片走私和未经授权的模型蒸馏,并加强防止模型权重遭窃的安全措施。
阿莫迪估计,如果美国有效执行上述措施,未来3至5年可进一步拉大美国领先中国的差距,从而为民主国家的安全节奏控制争取空间。
他认为,美中之间的全球AI协调仍值得推进,但不能天真,理所当然认定对方会遵守协议约束。
阿莫迪表示,“如果我们因为认为中方也会这样做而大幅限制自身的AI能力,而中方却背叛了我们,那么AI的强大程度可能会让北京最终占据地缘政治主导地位。”
“任何协议都必须具备高度可验证性,或限于即使一方违约,也不会改变军事与地缘政治生存条件的范围。”他补充说。
阿莫迪提出可由易至难的四级国际合作:禁止AI被用于生物武器;模型发布前进行网络安全、生物及对齐风险测试;对递归式自我改进设定某种“速度限制”;以及最终的全面限速或暂停。当中,他认为禁止特别危险用途与发布前测试较有可行性,全面暂停则短期内极不可能。
美国总统川普预定本月稍后在华盛顿与中共党魁习近平会面,AI安全与美中技术竞争预料将成为峰会的重要议题。


