中国军方资料为何也去了Claude?

博谈网 · 经八阕原文

Anthropic公布的新威胁报告,最引人注目的当然是中国模型公司大规模提取Claude能力。阿里被指在三个月内制造超过一点五亿次交互,用Claude的推理过程训练Qwen;Kimi与DeepSeek则被指把部分真实用户请求秘密转给Claude,再收集回答用于训练。

若被转送的只是数学题、编程题或公开资料,还可以找到不少温和解释:测试竞争对手、补充训练数据、降低研发成本,或者在少数困难任务上调用更强模型。蒸馏本来也是正常技术,只是手段是否合法、是否违反服务条款的问题。

可是报告中出现了解放军相关监控资料、公安系统数据、中国国企内部代码,甚至俄罗斯国防机构数据库的有效凭证。事情到了这一层,许多解释便站不住了。

总不能说,中国模型已经达到Claude的水平,只是为了做几个无关紧要的实验,顺便冒险把军方资料送进一家美国公司的服务器。更不能说企业有意出卖国家利益。对中国公司而言,这不只是商业丑闻,而可能触及数据出境、国家安全与保密责任。明知内容涉及军警仍然主动转送,近乎政治自杀。

更合理的解释是,这套转发已经进入真实产品流程,并由系统自动运行。平台可能识别出某项请求属于复杂编程、长程推理或智能体任务,便将它送给Claude,却没有先判断其中是否含有军事资料。公司追求的是Claude的高质量回答,以及由真实任务产生的珍贵训练数据;至于用户输入了什么,数据最终去了哪里,安全部门或者不知道,或者根本拦不住。

这个解释并不能替涉事公司减轻责任,反而暴露出更严重的问题:它们为了追赶美国模型,建立了一条规模巨大、未经用户知情同意、连军警资料都挡不住的境外数据管道。

这也为判断中国模型的真实水平提供了罕见证据。公开排行榜可以优化,标准化题目可以针对训练,普通聊天的差距也容易隐藏。可是企业愿意承担如此严重的泄密风险,说明Claude提供的并不是可有可无的两分改善。如果自家模型已经能够稳定完成同类任务,何必动用数千个欺诈账号,持续提取上亿次交互?何必把真实用户请求转给竞争对手,再冒充自己的回答?

这不能证明中国模型一无是处。它们在中文写作、普通问答、数学和短代码任务上,可能确实已经接近美国前沿模型。真正的差距,更可能集中在复杂软件工程、长程任务、工具调用、错误修正和智能体可靠性上。恰恰是这些难以用一张排行榜显示的能力,决定模型能否承担真正的生产工作。

军方资料的泄露,还带来另一重损失。美国公司看到的未必只是一份文件。工程师反复询问什么问题、代码卡在哪一步、使用什么硬件、连接什么数据库,都能反向暴露项目方向、技术瓶颈和组织关系。这是一种需求侧情报,有时比正式报告更有价值。

当然,Anthropic掌握日志,也有打击竞争对手的商业动机;具体归因仍需更多独立证据。但如果报告的基本事实成立,业界过去对中国模型能力的评估就必须下调。不是说它们没有能力,而是不能再把经过蒸馏、秘密调用乃至实时转发形成的产品表现,全部计算为独立自主能力。

最讽刺的地方正在这里:中国企业原想从Claude那里偷师,结果不但让Claude看见了自己的训练需求,也让它看见了本国军警系统正在做什么。它们未必想出卖国家利益,只是太想得到Claude的能力,终于把国家利益也一起送进了管道。这种代价,反过来正是能力差距最有分量的证词。

来源:博谈网(经八阕转载) · 查看原文
Scroll for more