轮到谷歌踩油门了,工程师因“太快”辞职
Gemini 4这两天,真的快被社媒漏成筛子了。
新检查点、新作品、新对比图,一茬接一茬往外冒。
就在刚刚,Lumina又放出了一组挺有节目效果的测试:
同一道「鹈鹕骑自行车」,Gemini 4 Pro前后两个检查点,直接画出了两种完全不同的风格。
Checkpoint 1走的是鲜艳卡通风;Checkpoint 2则明显更克制,像一张机械结构草图。
两个检查点放在一起,已经能明显看出后训练留下的痕迹:线条、结构、细节处理都在变。模型能力已经肉眼可见地往前蹿了一截。
而这,已经数不清是Arena里,冒出的第几个疑似Gemini 4 Pro的新检查点了。
社区这边还在疯狂扒细节,谷歌自己也不藏了。
本周,谷歌DeepMind新掌门Koray Kavukcuoglu首次对媒体确认:Gemini 4已经进入后训练早期。
△图源Information
而且他的目标,是尽快发。
我们看到了效果,感到非常兴奋,接下来还会继续以快速迭代的方式推进工作。
好家伙。合着一轮轮冒出的checkpoint是给Gemini 4提前热场呢?
反正听Koray的语气,主打一个:能早发,绝不晚发。
而且这次提速的,还不只是模型。谷歌还准备把TPU芯片送上太空。
新项目即将启动原型测试,连AI算力基础设施都开始往地球之外伸。
Gemini 4,进入冲刺阶段
大家这么盯着Gemini 4,也不奇怪。
毕竟从上一代旗舰模型Gemini 3走到现在,谷歌中间没少折腾。
原本按计划,今年6月应该先等来Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月I/O开发者大会上提前预告过。
结果,没发。
中间虽然陆续更新了Gemini 3.1和几款Flash型号,但3.5 Pro一直没有正式亮相。
Koray这次也解释,团队中途选择「稍微暂缓一下」,先把精力放到Flash系列。
而现在,节奏明显又变了。
Koray明确说,要在尽可能短的时间内,实现最大的学习速度。
听话听音。这几乎把谷歌现在的打法挑明了。
虽然没有明确说谷歌是否正式取消了Gemini 3.5 Pro项目,但可以肯定的是,团队已经将全部注意力转向Gemini 4。
Gemini 3.5 Pro可以先放一放,但Gemini 4的训练、测试、反馈和再迭代,必须尽快一轮接一轮跑起来。
为此,谷歌已经开始同步搭建Gemini 4的内部安全保障和测试流程。目前这套机制已经先在内部AI编码工具上跑起来了。
这时候再看最近Arena里冒出来的疑似Gemini 4检查点,就更有意思了。
Lumina最新放出的「鹈鹕骑自行车」,大家的讨论中心已经从「哪个检查点更好」,变成了「Gemini 4到底追到哪一步了?」
有人直接喊出:Gemini is back in the game,认为如果这些检查点真实,谷歌正在快速缩小与OpenAI /Anthropic的差距。
也有人觉得它现在无法和GPT-6 SOL正面硬刚,和Anthropic今年春季推出、近期又完成升级的Mythos系列相比,也谈不上占尽优势。
面对质疑,Koray倒是相当有自信。
我对这个团队充满信心。我们肯定会一直处于前沿位置。
今年8月,哈萨比斯卸下Google DeepMind日常管理工作后,Koray正式接手这块业务,同时继续担任谷歌首席AI架构师。
Gemini接下来怎么跑、跑多快,Koray就是现在最关键的拍板人之一。
反正人家的话已经放这儿了,接下来就看Gemini 4自己能不能接住吧。
挑战英伟达,TPU首次上太空
如果只看Gemini 4,很容易以为谷歌这轮只是模型团队又开始加速。
其实更夸张的是,连算力都开始同步踩油门了。
Koray最近明确提到,DeepMind的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。
以前,TPU主要藏在Google Cloud后面,客户买的是云服务。但现在,谷歌开始直接卖TPU芯片了!
目标相当明确,挑战英伟达。
而且模型团队和芯片团队之间,也开始越绑越紧。
DeepMind做下一代模型时产生的新需求,会提前反馈给硬件工程师,让他们规划未来两到三代TPU。
模型:兄弟,我下一轮又准备吃✕✕算力了。
芯片:收到,现在开始造。


