轮到谷歌踩油门了,工程师因“太快”辞职

量子位 · 经八阕原文

Gemini 4这两天,真的快被社媒漏成筛子了。

新检查点、新作品、新对比图,一茬接一茬往外冒。

就在刚刚,Lumina又放出了一组挺有节目效果的测试:

同一道「鹈鹕骑自行车」,Gemini 4 Pro前后两个检查点,直接画出了两种完全不同的风格。

Checkpoint 1走的是鲜艳卡通风;Checkpoint 2则明显更克制,像一张机械结构草图。

两个检查点放在一起,已经能明显看出后训练留下的痕迹:线条、结构、细节处理都在变。模型能力已经肉眼可见地往前蹿了一截。

而这,已经数不清是Arena里,冒出的第几个疑似Gemini 4 Pro的新检查点了。

社区这边还在疯狂扒细节,谷歌自己也不藏了。

本周,谷歌DeepMind新掌门Koray Kavukcuoglu首次对媒体确认:Gemini 4已经进入后训练早期。

△图源Information

而且他的目标,是尽快发。

我们看到了效果,感到非常兴奋,接下来还会继续以快速迭代的方式推进工作。

好家伙。合着一轮轮冒出的checkpoint是给Gemini 4提前热场呢?

反正听Koray的语气,主打一个:能早发,绝不晚发。

而且这次提速的,还不只是模型。谷歌还准备把TPU芯片送上太空。

新项目即将启动原型测试,连AI算力基础设施都开始往地球之外伸。

Gemini 4,进入冲刺阶段

大家这么盯着Gemini 4,也不奇怪。

毕竟从上一代旗舰模型Gemini 3走到现在,谷歌中间没少折腾。

原本按计划,今年6月应该先等来Gemini 3.5 Pro。谷歌CEO劈柴哥甚至在5月I/O开发者大会上提前预告过。

结果,没发。

中间虽然陆续更新了Gemini 3.1和几款Flash型号,但3.5 Pro一直没有正式亮相。

Koray这次也解释,团队中途选择「稍微暂缓一下」,先把精力放到Flash系列。

而现在,节奏明显又变了。

Koray明确说,要在尽可能短的时间内,实现最大的学习速度。

听话听音。这几乎把谷歌现在的打法挑明了。

虽然没有明确说谷歌是否正式取消了Gemini 3.5 Pro项目,但可以肯定的是,团队已经将全部注意力转向Gemini 4。

Gemini 3.5 Pro可以先放一放,但Gemini 4的训练、测试、反馈和再迭代,必须尽快一轮接一轮跑起来。

为此,谷歌已经开始同步搭建Gemini 4的内部安全保障和测试流程。目前这套机制已经先在内部AI编码工具上跑起来了。

这时候再看最近Arena里冒出来的疑似Gemini 4检查点,就更有意思了。

Lumina最新放出的「鹈鹕骑自行车」,大家的讨论中心已经从「哪个检查点更好」,变成了「Gemini 4到底追到哪一步了?」

有人直接喊出:Gemini is back in the game,认为如果这些检查点真实,谷歌正在快速缩小与OpenAI /Anthropic的差距。

也有人觉得它现在无法和GPT-6 SOL正面硬刚,和Anthropic今年春季推出、近期又完成升级的Mythos系列相比,也谈不上占尽优势。

面对质疑,Koray倒是相当有自信。

我对这个团队充满信心。我们肯定会一直处于前沿位置。

今年8月,哈萨比斯卸下Google DeepMind日常管理工作后,Koray正式接手这块业务,同时继续担任谷歌首席AI架构师。

Gemini接下来怎么跑、跑多快,Koray就是现在最关键的拍板人之一。

反正人家的话已经放这儿了,接下来就看Gemini 4自己能不能接住吧。

挑战英伟达,TPU首次上太空

如果只看Gemini 4,很容易以为谷歌这轮只是模型团队又开始加速。

其实更夸张的是,连算力都开始同步踩油门了。

Koray最近明确提到,DeepMind的前沿模型研发,现在也在直接「反哺」谷歌自己的硬件业务。

以前,TPU主要藏在Google Cloud后面,客户买的是云服务。但现在,谷歌开始直接卖TPU芯片了!

目标相当明确,挑战英伟达。

而且模型团队和芯片团队之间,也开始越绑越紧。

DeepMind做下一代模型时产生的新需求,会提前反馈给硬件工程师,让他们规划未来两到三代TPU。

模型:兄弟,我下一轮又准备吃✕✕算力了。

芯片:收到,现在开始造。

来源:量子位(经八阕转载) · 查看原文
Scroll for more