谷歌DeepMind,已经破解RSI?
谷歌跑通RSI了?!
一个名叫「rsi-model-liverl-le」的模型,突然出现在Google生成式语言API的返回结果里。
没错,就是那个RSI(递归自我改进,Recursive Self-Improvement)。
谣言正在像野火一样蔓延,称谷歌 DeepMind 已经实现了RSI。
就在网友Chubby还在推测之际,Anthropic CEO突然公开宣布全行业包括Anthropic,RSI在各处已经开始发生。
这让Chubby相信传言是真的:RSI已经被实现了!
据爆料,Google内部不止跑着这一个模型。在同一批标签下,还赫然挂着从00到09编号的10个专属训练槽位。
Google的反应堪称神速,当晚就紧急收回了一批相关API密钥。
然后,就没有然后了。Google和DeepMind至今一个字没说。
一句藏头诗,一张截图,一批被收回的密钥
这起风波,源于一句看似普通的祝贺。
9月11日晚,爆料账号lyra给Google DeepMind发了条帖子,「huge congRatulationS Indeed! @GoogleDeepMind」。
细心的人一眼就能看出,三个被刻意大写的字母拼在一起,正是RSI。
lyra的藏头帖
几个小时后,另一个账号Lentils直接甩出了实锤截图。
Google的API返回了一段JSON代码,模型代码为「rsi-model-liverl-le」,显示名称为「RSI Model LiveRL LE」。参数规格是输入上限1048576个token,输出上限65536个token。
Lentils的原话是,「想象一下,如果GDM(Google DeepMind)内部真有个叫rsi-model-liverl-le的东西。再想象一下,他们还有10个专属的rsi-model-liverl-ns-xx训练槽位,从00编到09。这难道不疯狂吗?」
Lentils放出的API返回截图
LiveRL是什么?虽然没有官方解释,但X上普遍的共识是「在线强化学习(Live Reinforcement Learning)」,即模型一边跑业务,一边自我进化。
接下来这一步,彻底让全网炸锅。
lyra直接发文@了Google AI Studio负责人Logan Kilpatrick,「没必要因为怕我,就把GDM的API密钥全收回去。你们的基础设施有更深的安全漏洞,直接联系我就行。」
随后他补了一记重锤,这批密钥来自GDM内部员工,可以访问超过1000个内部checkpoint。
lyra公开@Logan Kilpatrick
Lentils紧随其后嘲讽,「我闻到了恐惧的味道。」
虽然这张截图的真伪尚未得到第三方验证(1048576和65536这两个数字与Gemini现有系列的规格完全一致,不排除是内部测试名或恶作剧的可能)。
但它能一夜刷屏,是因为它和Google最近的报道,严丝合缝地对上了。
谷歌拉响紧急警报,微厨房里豪赌RSI
三天前,Business Insider报道称,谷歌联创Sergey Brin对谷歌在Gemini上的进展速度感到不满,并力促员工更加专注于递归自我改进。
早在今年8月,路透社就已经报道过同样的方向:Brin希望谷歌追赶上前沿,并正在将资源推向RSI。
据9月9日Business Insider的独家报道,Sergey Brin回归Google后的办公地点,是总部Gradient Canopy大楼里一间改造过的微厨房。
他坐在一张U形桌旁,旁边是DeepMind现任负责人Kavukcuoglu,而劈柴哥(Sundar Pichai)每周都会来这待上几次。
一位前员工透露,「Sergey想把Gemini当成一家创业公司来管。」另一位员工则直言,「这间厨房的存在,就是为了能直接绕开公司政治。」
他管的细节极其硬核。
他直接插手芯片分配,为Gemini团队开辟了一条正式流程之外的「算力特权通道」;他曾主导砍掉了Jeff Dean的「Frozen」芯片项目,今年又再次削减其资源。
他甚至在内部推行了一项激进计划,监控部分员工的编码过程,用这些真实数据去训练Gemini的代码能力。
他只有一个核心诉求:全公司必须以最快速度,向「递归自我改进(Recursive Self-Improvement,简称 RSI)」发起总攻。
一名前员工在接受采访时用了一个极其贴切的词来形容他:
他深度押注了RSI,他彻底被「AGI洗脑」(AGI-pilled)了。
路透社在8月的报道中也提到,Brin早在4月的全员会上就催促DeepMind加快步伐,将资源全面向RSI倾斜。
一位前员工更是坦言,「他非常相信RSI,他是一个彻头彻尾的AGI信徒。」
把这件事带火的ChrisGPT,附上了BI报道原文
Brin如此急迫的动机并不难猜,Google掉队了。
Gemini 3去年11月短暂登顶后,迅速被Anthropic和OpenAI反超。新一代旗舰模型因编码能力不达标,硬生生推迟了两个月。
与此同时,核心人才在不断流失。Jeff Dean在效力27年后离职创业,Oriol Vinyals、John Jumper等大牛先后出走,Hassabis也于8月5日卸任DeepMind负责人。


