Gemini 3.8登顶,谷歌迈出RSI一大步新智元

9/3/2026

突发!Gemini 3.8登顶,谷歌迈出RSI一大步

就在刚刚,谷歌杀回来了!

今夜,谷歌正式发布了Gemini 3.8 Flash,以及专攻网络安全的Gemini 3.8 Flash Cyber。

这是谷歌在短短六周内,连续发布的第三个Flash版本。

前两次更新,看起来只是热身,因为这一次,谷歌直接把性价比推到最前沿——

单任务成本0.58美元!输入仅仅0.75美元/百万Tokens!

就是这么一个「白菜价」的小模型,在多项核心基准测试中,硬生生摸到了全球最强旗舰Opus 5、GPT-5.6 Sol以及Grok 4.6的门槛。

谷歌DeepMind大牛姚顺宇评价说:对模型而言,这只是迈出了一小步;但对于 RSI来说,这是一次巨大飞跃。

X上,开发者们已经炸了。

有人实测后,发出灵魂拷问:「天哪,谷歌是不是发错货了?这不就是一直没放出来的Gemini 3.5 Pro吗?拿着Flash的价格,干着Pro的活!」

「DeepMind团队里,大概有人从7月份开始就没合过眼。」

所有人还在消化Fable 5.1的时候,谷歌又一次掀翻了牌桌。

谷歌「卷王」回来了:性价比之王

沉寂许久的谷歌,用极其内卷的方式,向世界宣告:大魔王杀回来了。

要理解Gemini 3.8 Flash带来的震撼,我们必须先看看当今AI市场的格局。

本来,在Artificial Analysis测试中,已经形成了极其森严的壁垒。你要想拥有顶级的智力(Intelligence Index达60分左右),就必须付出高昂的Token成本。

结果,Gemini 3.8 Flash就像一个刺客,简直不讲武德。

在Artificial Analysis的高推理模式下,Gemini 3.8 Flash的智力指数飙升到了59分!

这是什么概念?这距离最顶级的GPT-5.6 Sol和Grok 4.6仅有一步之遥,甚至在某些维度上超越了Claude Opus 5!

而做到这一切的代价呢?它的单任务成本仅为0.58美元。

具体来说,输入成本维持在0.75美元/百万Tokens,输出3.75美元/百万Tokens。

谷歌做了一张图:在智力与成本的帕累托前沿上,Gemini 3.8 Flash那个代表「最高效」的蓝点位于软件工程基准DeepSWE的右上角,把第二名甩出了一条街。

Gemini 3.8 Flash不仅聪明,还快得离谱。它的生成速度达到了惊人的 305 tokens/s,而下一档的模型才勉强跑到154 tokens/s。

「又快、又聪明、还便宜得像不要钱,这才是人类真正能天天用的模型。」

尤其在长周期软件工程基准(DeepSWE v1.1)上,3.8 Flash打出了 73.7% 的惊人成绩。

在这个需要AI自主解决复杂工程问题、端到端写代码的测试中,它不仅超越了大多数昂贵的前沿大模型,而且成本仅仅是后者的零头。

要知道,这只是「Flash」版,并不是「Pro」,更不是「Ultra」。

这一次,谷歌又一次让小模型抢了旗舰模型的饭碗。

有人亲测了Gemini 3.8 Flash和Opus 5做同一任务。

这种在编程能力上的大幅跃升绝非偶然。

据报道,在谷歌内部的代码工具Jetski的测试中,谷歌工程师们甚至已经更倾向于使用3.8 Flash,而不是Anthropic的Opus模型。

这背后是谷歌从年初开始就在强化学习上猛砸资源——也就是模型训练的「后期打磨」阶段,让模型在试错中真正学会干活。

Google DeepMind组建了一支代码突击队,专注于提升编程模型能力,这个团队由DeepMind CTO领导,联创谢尔盖·布林直接监督。

他们的目标是,逼出递归自我进化,把编程模型硬生生改造成全自动AI研究员,彻底打通整个研发闭环。

Scroll for more