GPT-6 Sol 与 Luna 把价格砍了一半,而这次不是促销价是默认价

Sam Altman 于 9 月 22 日在 X 上宣布 OpenAI 同日下午发布 GPT-6 Sol 与 GPT-6 Luna,把 GPT-6 家族向 9 月 3 日发布的旗舰 Astra 之下延伸。三档定位为:Astra 面向最难的工作,Sol 面向复杂编程与专业任务但成本更低,Luna 面向高并发的日常快速任务。定价方面,GPT-6 Sol 为每百万输入 2 美元、输出 10 美元,对照 GPT-5.6 Sol 的 4 美元与 20 美元;GPT-6 Luna 为 0.10 美元与 0.50 美元,对照 GPT-5.6 Luna 的 0.20 美元与 1.20 美元。两处口径需要说清:GPT-5.6 那一档的价格本就是促销性质,而据 OpenAI 发言人向 The New Stack 表示,新的 GPT-6 价格是默认价而非促销;另外 Luna 的输出价降幅约为 58%,不是 50%。OpenAI 同时对缓存输入读取提供 90% 折扣,并称其缓存改进使需要重新处理的 token 量减少一半以上,该数据来自流经 GitHub Copilot 的数十亿次请求。性能方面,公司称在其内部事实性测试中 Sol 的错误约为前代的一半,Luna 在较高 effort 下可匹配 GPT-5.6 Sol 而成本约为其百分之一;在 OSWorld 2.0 离线测试中,Sol 在 xhigh 档得 60.5%,对照 Opus 5 在 medium 档的 60.3%,每任务成本低约 80%。可用性上,两款模型在 API 中以 gpt-6-sol 和 gpt-6-luna 提供,均为纯 API 模型、没有可自托管的权重;在 ChatGPT 中,Sol 与 Luna 面向多数付费账户在 ChatGPT Work 和 Codex 中提供,Luna 另向 Free 与 Go 用户在桌面应用中开放。竞争背景是:Anthropic 的 Claude Opus 5.5 据 TechCrunch 报道比 OpenAI 的公告早约 90 分钟发布、定价 4 美元与 20 美元,xAI 的 Grok 4.7 也在同一个 48 小时内发布,而 Google 的 Gemini 3.8 Flash 促销价持续至 12 月、为 0.75 美元与 3.75 美元。此次发布在 OpenAI 9 月 29 日 DevDay 之前。

「默认价」这三个字比「砍一半」更重要

对照的两边性质不一样:GPT-5.6 那一档的价格本就是促销性质的,而据 OpenAI 发言人说法,Sol 与 Luna 的价格是默认价。 这个区别对做预算的人比降幅本身更要紧。**促销价意味着你得在日历上标一个到期日并准备好届时重新谈;默认价意味着价格锚点下移了。**前者是一笔要还的账,后者是可以写进三年成本模型的数字。 本站 9 月 1 日写过一个正反面的例子:Claude Sonnet 5 发布时标注 $2/$10 为优惠价、有效期至 8 月 31 日,9 月 1 日本应涨到 $3/$15,最后 Anthropic 取消了这次上调、$2/$10 成为标准价。当时的结论是不少第三方定价指南仍按旧价列——**这类价格的性质变化比数字变化更容易在传播中丢失**,今天这条也是同一个要点。 顺带修正一个在转述中常见的数字:Luna 的输出价从 1.20 美元降到 0.50 美元,降幅约 58%,不是 50%。输入价那一档才是正好一半。

48 小时内三家动价格,比的不是基准分

时间线值得记下来:据 TechCrunch,Anthropic 的 Opus 5.5 比 OpenAI 的公告早约 90 分钟;xAI 的 Grok 4.7 也在同一个 48 小时里;Google 的 Gemini 3.8 Flash 促销价则一直挂到 12 月。 而最能说明这场竞争形状的是一个巧合般的结果:**Sol 的价格正好是 Opus 5.5 的一半,两个维度都是**(2 对 4,10 对 20)。Sol 的定价也与 Claude Sonnet 5 持平。也就是说同一天里,两家把各自的中档主力摆在了 2 倍价差上,而不是在某个基准分上争先后。 本站今天另有一条写 Opus 5.5,两条放在一起看会更清楚:推理定价已经进入正面竞争,而各家用的手法不同——OpenAI 是新开更便宜的档位并声明为默认价,Anthropic 是在旗舰上降价 20% 并把缓存读取降 60%、同时加订阅侧额度。**降价发生在哪一层,决定了谁会受益:**新档位利好愿意换模型的人,缓存降价利好长上下文重复读的人,订阅额度利好不走 API 的人。

最有参考价值的数字来自真实生产流量

这次公告里有一条比任何基准分都值得看:OpenAI 称其缓存改进使需要重新处理的 token 量减少一半以上,而这个测量来自流经 GitHub Copilot 的数十亿次请求。 **这是生产流量而非评测集。**再叠加缓存输入读取 90% 的折扣,对高频重复上下文的应用(编程助手、客服、检索增强),实际账单的改善可能远大于价目表的 50%。同样地,这也意味着如果你的调用几乎没有可复用的前缀,你能拿到的就只有价目表那一半。 相比之下,两条性能主张需要按口径读: **OSWorld 2.0 的 60.5% 对 60.3%**——Sol 在 xhigh 档,Opus 5 在 medium 档。这不是同条件对比,而是厂商自选的对照组合。当然「达到同等分数所需成本低约 80%」本身是一个合理的商业指标,只是它回答的是「多少钱买到这个分数」,不是「谁更强」。 **Luna 在较高 effort 下匹配 GPT-5.6 Sol、成本约百分之一**——如果成立,对高并发的分类、路由、抽取类任务是量级变化。但这是厂商内部测试,而这类任务恰恰最容易自测:拿你自己的一批样本跑一遍,一小时就有答案。

纯 API、没有权重,这是一条值得记的分界

Sol 与 Luna 都是纯 API 模型,没有可自托管的权重。 把这一条和本站 9 月 21 日的两条放在一起,这一周正好凑齐了三种姿态:**Qwen-Image-2.1 放权重但许可收成仅限研究;StepFun 的 Step 5 Preview 承诺 10 月 15 日放权重;GPT-6 这一档则根本不提供权重。**对必须自托管的场景——数据不能出境、要离线部署、或者要长期锁定某个版本——降价这件事与你无关,因为这条路上没有 GPT-6。 最后一个日程:这次发布在 9 月 29 日 DevDay 之前。在一场开发者大会前一周把价格砍到默认价,通常意味着大会上还有别的东西要讲。

via: The New Stack 报道The Next Web 报道MarkTechPost 报道Quartz 报道