GPT-6 Sol和Luna上线,打折太狠了

字母榜 · 经八阕原文

今夜注定无眠。

Opus 5.5刚刚发布90分钟,OpenAI就把GPT-6 Sol和Luna一起端了上来。

前脚Anthropic刚把Opus的价格砍了一刀,后脚OpenAI直接把刀砍得更深。

GPT-6 Sol每百万Token输入只要2美元、输出10美元,价格正好只有Opus 5.5的一半,Astra的五分之一。

Luna更夸张,只要0.1美元和0.5美元,直接砍到Astra的1%。

这一晚上,模型能力还没来得及被检验,价格战先打起来了。

便宜,但没缩水

Astra仍然是GPT-6系列的最高档,OpenAI明确表示,如果任务足够重要、足够困难,而且不想在能力上做任何妥协,继续选Astra。

新来的Sol和Luna的任务,是把Astra的能力往更便宜的模型里塞。

OpenAI表示,两款模型采用了与Astra相似的训练方法,把这一代在专业工作、事实准确性、Coding、Computer Use和Alignment上的进步给“下放”了。

其中,GPT-6 Sol的定位为复杂Coding和Agent工作流的主力模型,Luna则负责高频、大规模、任务相对集中的工作,核心就是快和便宜。

两款模型都是105万Token上下文、最大128K Token输出,和Astra处于同一档;都支持文本和图片输入,网页搜索、文件搜索、代码解释器、Computer Use、MCP、Skills等工具也都可以正常调用。

它俩的推理档位甚至比Astra多一个选项。Astra只有low、medium、high、xhigh和max,Sol和Luna则多了一个none,可以把推理关掉。默认档位均为medium。

Sol的知识截止日期是2026年4月20日,Luna反而更新一些,到2026年5月18日。有意思的是,Astra的知识截止日期是2026年4月30日,卡在两个新模型中间。看来知识截止日期和模型“档位高低”并不是一回事。

然后再看价格。GPT-6 Sol每百万Token输入2美元、输出10美元,缓存输入只要0.2美元;GPT-6 Luna更狠,每百万Token输入0.1美元,输出0.5美元,缓存读取甚至低到了0.01美元。

而且这还不是价格的下限。Batch和Flex模式继续半价,缓存命中的输入Token也只按照普通输入价格的10%收费。

不过,百万上下文不能从头到尾都按这个价格算。

OpenAI规定,一旦单次请求的输入超过27.2万Token,整个请求都会按照长上下文价格收费:输入和缓存价格翻倍,输出提高50%。

所以Sol塞进超长上下文以后,会变成4美元输入、15美元输出;Luna则变成0.2美元和0.75美元。

105万上下文是真的,0.1美元也是真的,但两个数字不能直接乘起来。

价格降得很夸张,但性能并没有摆烂。

OpenAI用Sol证明了,原本需要旗舰模型花很多钱才能做的事,现在可以便宜很多。

比如跨应用Agent测试AutomationBench——由于OpenAI的文档里不包含刚发布的Opus 5.5,所以我们去找了Zapier的公开榜单。

在这项测试里,GPT-6 Sol开到xhigh拿到33.2%,单任务成本只有0.27美元。

如果只看绝对能力,它还打不过刚发布的Opus 5.5,后者max档做到40.0%,仅次于Astra max的41.4%。但Opus 5.5每项任务要1.28美元,几乎是Sol的4.7倍;Astra则要1.73美元,是Sol的6.4倍。

虽然Sol没有拿下第一,但它用不到0.3美元的价格,已经挤进了同一张前沿Agent榜单。

Coding也是一样。

在真实代码库软件工程测试DeepSWE v1.1里,GPT-6 Sol max拿到68.8%,距离Fable 5此前最高的69.9%只差1.1个百分点,但OpenAI估算单任务成本低约80%。

Luna则更加夸张,这个每百万输入Token只卖0.1美元的模型,max档也跑到了66.6%的水平。

OpenAI称,这已经接近Opus 5和Fable 5的medium档,但单任务成本分别低了93%和96%。

在测试Computer Use的OSWorld 2.0上,Sol xhigh拿到了60.5%,和Opus 5 medium的60.3%基本打平,成本却降了大约80%;Luna开到max,也能超过上一代GPT-5.6 Sol medium,而成本只有后者的大约十分之一。

不过需要说明的是,虽然Anthropic当天公布的Opus 5.5成绩高达81.8%,但这组成绩来自Anthropic自己的OSWorld 2.0评测设置;OpenAI公布的60.5%,则是在2026年8月8日版本的离线任务集上,按照部分完成度得分统计出来的。两边并不是同一套公开横测,不能直接比较。

要看Sol和Opus 5.5谁的Computer Use更强,得等同一套第三方测试。

GPT-6 Sol和Luna今天已经进入ChatGPT Work和Codex,Plus、Pro、Business、Enterprise和Edu用户都可以使用;Free和Go用户也可以在桌面App里使用GPT-6 Luna。

开发者则可以直接通过API调用,模型ID分别是gpt-6-sol和gpt-6-luna。

目前两款模型还没有进入普通Chat。Work和Codex则会在当天逐步完成推送,如果现在还没看到,可能只是还没轮到。

熟悉的Tibo重置,同样也没有缺席。

新模型、永久降价,再送一次额度重置,这个发布夜算是把“便宜”贯彻到底了。

来源:字母榜(经八阕转载) · 查看原文
Scroll for more