「默认价」这三个字比「砍一半」更重要
对照的两边性质不一样:GPT-5.6 那一档的价格本就是促销性质的,而据 OpenAI 发言人说法,Sol 与 Luna 的价格是默认价。 这个区别对做预算的人比降幅本身更要紧。**促销价意味着你得在日历上标一个到期日并准备好届时重新谈;默认价意味着价格锚点下移了。**前者是一笔要还的账,后者是可以写进三年成本模型的数字。 本站 9 月 1 日写过一个正反面的例子:Claude Sonnet 5 发布时标注 $2/$10 为优惠价、有效期至 8 月 31 日,9 月 1 日本应涨到 $3/$15,最后 Anthropic 取消了这次上调、$2/$10 成为标准价。当时的结论是不少第三方定价指南仍按旧价列——**这类价格的性质变化比数字变化更容易在传播中丢失**,今天这条也是同一个要点。 顺带修正一个在转述中常见的数字:Luna 的输出价从 1.20 美元降到 0.50 美元,降幅约 58%,不是 50%。输入价那一档才是正好一半。
48 小时内三家动价格,比的不是基准分
时间线值得记下来:据 TechCrunch,Anthropic 的 Opus 5.5 比 OpenAI 的公告早约 90 分钟;xAI 的 Grok 4.7 也在同一个 48 小时里;Google 的 Gemini 3.8 Flash 促销价则一直挂到 12 月。 而最能说明这场竞争形状的是一个巧合般的结果:**Sol 的价格正好是 Opus 5.5 的一半,两个维度都是**(2 对 4,10 对 20)。Sol 的定价也与 Claude Sonnet 5 持平。也就是说同一天里,两家把各自的中档主力摆在了 2 倍价差上,而不是在某个基准分上争先后。 本站今天另有一条写 Opus 5.5,两条放在一起看会更清楚:推理定价已经进入正面竞争,而各家用的手法不同——OpenAI 是新开更便宜的档位并声明为默认价,Anthropic 是在旗舰上降价 20% 并把缓存读取降 60%、同时加订阅侧额度。**降价发生在哪一层,决定了谁会受益:**新档位利好愿意换模型的人,缓存降价利好长上下文重复读的人,订阅额度利好不走 API 的人。
最有参考价值的数字来自真实生产流量
这次公告里有一条比任何基准分都值得看:OpenAI 称其缓存改进使需要重新处理的 token 量减少一半以上,而这个测量来自流经 GitHub Copilot 的数十亿次请求。 **这是生产流量而非评测集。**再叠加缓存输入读取 90% 的折扣,对高频重复上下文的应用(编程助手、客服、检索增强),实际账单的改善可能远大于价目表的 50%。同样地,这也意味着如果你的调用几乎没有可复用的前缀,你能拿到的就只有价目表那一半。 相比之下,两条性能主张需要按口径读: **OSWorld 2.0 的 60.5% 对 60.3%**——Sol 在 xhigh 档,Opus 5 在 medium 档。这不是同条件对比,而是厂商自选的对照组合。当然「达到同等分数所需成本低约 80%」本身是一个合理的商业指标,只是它回答的是「多少钱买到这个分数」,不是「谁更强」。 **Luna 在较高 effort 下匹配 GPT-5.6 Sol、成本约百分之一**——如果成立,对高并发的分类、路由、抽取类任务是量级变化。但这是厂商内部测试,而这类任务恰恰最容易自测:拿你自己的一批样本跑一遍,一小时就有答案。
纯 API、没有权重,这是一条值得记的分界
Sol 与 Luna 都是纯 API 模型,没有可自托管的权重。 把这一条和本站 9 月 21 日的两条放在一起,这一周正好凑齐了三种姿态:**Qwen-Image-2.1 放权重但许可收成仅限研究;StepFun 的 Step 5 Preview 承诺 10 月 15 日放权重;GPT-6 这一档则根本不提供权重。**对必须自托管的场景——数据不能出境、要离线部署、或者要长期锁定某个版本——降价这件事与你无关,因为这条路上没有 GPT-6。 最后一个日程:这次发布在 9 月 29 日 DevDay 之前。在一场开发者大会前一周把价格砍到默认价,通常意味着大会上还有别的东西要讲。
via: The New Stack 报道、The Next Web 报道、MarkTechPost 报道、Quartz 报道