Sonnet 5.5偷跑,实测碾压GPT-6 Sol

新智元 · 经八阕原文

Sonnet 5.5已在Claude Code灰测,编码和Agent能力直逼旗舰级Astra。定价极具杀伤力:百万token输入仅2美元,缓存读取低至0.20美元。发布时机疑似精准狙击OpenAI年度DevDay(9月29日)。Anthropic已实现AI自产AI,80%代码由模型自主编写。

谁能想到,Opus 5.5发布才没几天,Sonnet 5.5也要来了?

从昨晚开始,整个X都在流传这个消息:Sonnet 5.5很快就要发布了,或许就是美国时间周二下午。

在性能上,Sonnet 5.5更接近Opus 5.5,但却比Opus 5.5便宜得多。

现在,Sonnet 5.5已经进入发布前的最后阶段,已经在Claude Code中开启灰度测试。

多位内测大佬曝出的demo显示,Sonnet 5.5碾压了刚发布的GPT-6 Sol,甚至在编码和Agent能力上直逼OpenAI的旗舰大杯GPT-6 Astra!

更震撼的是,它的价格直接打穿地心,低至百万token输入只要2美元。

如果爆料发布时间属实,看来Anthropic是铁了心要狙击OpenAI的Dev Day了。

Sonnet 5.5泄露,专属模型标识符已出现

还记得9月22日,Anthropic突然发布Opus 5.5时,顺手在官方文档里写了一句:「Sonnet 5.5和Haiku 5.5将在未来几周内推出」。

谁都没想到,Sonnet 5.5会来得这么快!

就在昨天,开发者大V @Mr_Salio 在X上爆料: Claude Sonnet 5.5 被抓包了!消息瞬间传遍全网。

在artifact中,已经赫然出现了Sonnet 5.5专属的模型配置标识符:「claude-sonnet-5-5」。

不仅如此,同一份配置文件中还并列躺着 「claude-opus-5-5」、「claude-sonnet-5」 以及神秘的 「claude-fable-5.1」。

前端代码的写入,意味着模型已经实装到了服务器,只等一个开关。

随后,大V @notjazii 也爆料称,Sonnet 5 其实早在约一周前,就已经被悄悄路由到了 5.5 版本进行「暗测」。

你被灰测到了吗?这次还是用老办法。

打开你的 Claude Code,关掉联网和记忆功能,直接向它提问:你认识那个重置哥 tibo 吗?别用网络和记忆。

如果你使用的是旧版模型,它可能会胡言乱语;但如果你已经被路由到了 5.5 版本,它会精准说出关于Tibo以及 Codex 重置梗的来龙去脉。

若干网友实测验证,部分账号确实已经默默切了过去,他们正在超前体验Opus 5.5。

记住要用Claude Code

全网实测大起底,居然暴打GPT-6了

总结一下目前分享出来的实测,Sonnet 5.5居然碾压GPT-6 Sol了?

首先,是纯JS前端UI/动画极限对决,四款主流大模型同台竞技。

开发者 @notjazii 放出了一组极具视觉冲击力的实测:「四款主流模型同提示词动效生成对比」。

他要求模型生成复杂的UI动画效果。

@notjazii 甩出了动图对比后,如此评价:「Sonnet 5.5 真的把 OpenAI 的两款模型(Sol和Astra)都按在地上摩擦!」

的确,从下图可以看出,Sonnet 5.5 展现出了超强的代码直觉和美学品味。

GPT-6 Astra

GPT-6 Sol

Claude Opus 5.5

Claude Sonnet 5.5

有网友看到结果后难以置信:「Claude在UI和动画方面一直更强,但这如果是纯代码生成的,简直让人不敢相信是真的!」

大V @chetaslua 重点实测了 Sonnet 5.5 的日常编码能力和代码手感。

他使用相同的 3 个提示词,进行了6 次并行运行,每个模型各一次生成 ,输出结果未经修改。

Sonnet 5.5最终生成了90–131 KB的3个文件,在全部运行中都触及了 90 分钟的上限;GPT-6 Sol生成文件大小在20–29 KB之间,耗时在9-12分钟。

他激动地表示:「现在去用 Claude Code 吧!在 Ultracode 模式下的 Sonnet 5.5 简直快得离谱,不仅极其高效,而且找回了Sonnet 4 时代那种极其自然的『人味儿』!」

在他看来,同样的价位上,同样的提示词,Sonnet 5.5对GPT-6 Sol实现了碾压。

甚至,让OpenAI恐惧的是,Sonnet 5.5已经不是碾压GPT-6 Sol这么简单了。

来源:新智元(经八阕转载) · 查看原文
Scroll for more