
OpenAI与Anthropic降价,DeepSeek在OpenRouter激增
GPT-6 Sol/Luna 计划削减 50% 的成本,而 Opus 5.5 的价格预计便宜约 40%,同时 DeepSeek V4.1 Flash 记录了 172% 的每周使用激增。
新的发布周期正在推动旗舰AI模型的成本下降,OpenAI和Anthropic不仅仅是对旧版本进行降价,而是大幅降低价格。来自OpenRouter的早期使用数据表明,DeepSeek的V4.1 Flash本周以172%的激增排名第一,这与每个token更便宜的定价一致,尽管实验室面临利润压力,但需求仍在扩大。
关键要点
- OpenAI计划发布GPT-6索尔周二,GPT-6 Luna的费用对顶级商业客户降低了50%,与之前版本的同类模型相比。
- Anthropic 还将 Opus 5.5 定位在周二发布,表示其运行成本比 Opus 5 低约 40%,同时保持“顶级智能”。
- xAI在周一发布了Grok 4.7,并以性价比进行营销,但竞争对手的发布在24小时内缩小了大部分价格优势。
- DeepSeek的V4.1 Flash在OpenRouter的排行榜上排名第一,并在“本周”记录了172%的使用量激增。
旗舰模型迅速降价:GPT-6 Sol/Luna、Opus 5.5 和 Grok 4.7
本周的AI发布节奏被宣传得不再像单纯的能力竞赛,而更像是价格表的重写。OpenAI计划在周二发布GPT-6 Sol和GPT-6 Luna,将顶级商业客户的成本降低50%,与同型号的先前版本相比。
Anthropic计划在同一天发布Opus 5.5,并表示其运行成本比Opus 5低约40%,同时保持顶级智能。共同点是最新“旗舰”级别的明确成本压缩,而不仅仅是在新产品发布后对旧型号价格的常规降低。
xAI的举动设定了节奏。埃隆·马斯克的xAI在周一发布了Grok 4.7,将该模型定位于性价比,竞争反应迅速。在24小时内,新选项大幅减少了Grok 4.7的价格优势,迅速提醒人们,前沿模型的定价权可能在一个新闻周期内蒸发。
每个令牌的成本解释:为什么降价会增加总的AI支出
在这场斗争中,重要的单位是令牌。每个令牌的成本是提供商处理或生成一单位文本所收取的价格,这是比较模型之间运营成本的最简单方式,当其他一切都在变化时。
降低每个令牌的价格并不意味着市场在AI上的支出会减少。机制很简单:当一个模型变得更便宜时,开发者会推出更多之前过于昂贵的功能,用户会进行更长的会话,公司会通过模型推动更多的工作流程,而不是将其保留用于“高价值”提示。这可能会提高总令牌量,足以使总支出持续增长,即使每个令牌的价格下降。
这种动态是杰文斯悖论的直觉,经济学的观点是,当一种资源变得更便宜时,总消费可能会增加而不是减少。在这种情况下,“资源”是推理,赌注是较低的价格解锁足够的新使用,以保持计算计量器的运行。
卖方框架在数据包中倾向于这种量的故事。Citadel Securities告诉客户,下降的每个令牌成本正在推动额外的使用,总体AI支出正在增加,这表明AI实验室或提供AI使用背后计算能力的公司的最终利润会更高。摩根士丹利提出了类似的需求侧案例,将来自中国供应商的竞争框架视为看涨AI,因为更便宜的访问可以吸引更多客户并增加对计算的整体需求。
采用证明点:DeepSeek V4.1 Flash在使用量跃升172%后超越OpenRouter
数据包中最干净的数据点不是基准分数,而是排行榜和使用激增。
DeepSeek的V4.1 Flash在OpenRouter的排行榜上排名第一,并在“本周”记录了172%的使用激增。OpenRouter是一个聚合器,可以跨多个模型路由请求,并发布交易者和开发者用作采用势头粗略代理的排名。
DeepSeek也是数据包用来定义对 incumbents 的开放权重压力的例子。开放权重模型是指训练参数可供他人运行或微调的模型,这通常比完全封闭的产品更便宜或更灵活。数据包指出,DeepSeek表示V4.1 Flash在多个基准测试中超越了其之前的旗舰产品,这得益于技术更新,使其能够收取更低的费用,尽管这里没有提供基准套件和结果。
更广泛的观点是竞争性的,而不是意识形态的。当开放权重提供商在广受关注的排名中攀升并削减价格时,他们迫使封闭实验室在成本上做出回应,而本周的旗舰定价语言就像是这种回应。
交易者确认清单:使用与收入、定价底线和排行榜份额。
第一个确认点是价格削减是否在唯一重要的地方真实:发布后的定价页面和企业条款。OpenAI对顶级商业客户表示的50%的降幅和Anthropic对Opus 5.5的约40%的运行成本降低都是很大的数字,但数据包没有包含绝对的$/token数字或哪些客户和使用层级符合的确切范围。
第二个是OpenRouter的排名和使用趋势是否在接下来的一到两周内保持DeepSeek V4.1 Flash在第一或接近第一的位置,或者排行榜在周二的旗舰发布后是否会回落。一周的激增可能是新奇、激励或路由默认。持续的市场份额是一个不同的声明。
第三是使用与收入的桥梁。数据包标记了OpenAI和Anthropic的利润压力,因为价格战加速,目前尚不清楚更高的token量是否会在每token定价压缩时转化为持续的收入增长。
最后,观察重新定价传播的速度。Grok 4.7在24小时内被竞争对手赶超的优势是模板。如果相同的快速重新定价影响更多的“闪电”或小变种,市场可能会朝着由拥有最便宜计算和最佳分发的公司设定的定价底线发展,而不是由谁赢得单个旗舰发布。
我的看法:价格战看起来像是实验室的利润故事——以及计算的量故事。
决定这一点的因素不是哪个模型是“最佳”的,而是更便宜的推理是否足以扩大工作负载,从而使总支出持续上升。该数据包的确凿证据虽然狭窄,但方向一致:DeepSeek的V4.1 Flash在OpenRouter上以172%的周使用量飙升位居第一,这就是Jevons悖论需求在实际中的表现,甚至在周二旗舰产品降价之前。
真正的考验在于发布后的定价页面和企业条款是否确认了所述的50%和约40%的降幅,以及在新旗舰产品发布后,排行榜的份额是否保持稳定。如果这两者一致,设置就开始显得结构性:实验室在打价格战,而计算需求在量上保持高位。