Dimly lit server room with blue and orange lights
人工智能

OpenAI与Anthropic推出更便宜的GPT-6和Claude Opus 5.5

OpenAI 提到与 GPT-5.6 促销定价相比,API 价格降低了 50%,而 Anthropic 则通过代币效率提出了约 40% 的运行成本降低。

作者:Elliot Marsh阅读 4 分钟

OpenAI 和 Anthropic 于 9 月 22 日分别推出了更低成本的模型选项,围绕降低客户推理支出进行发布,因为更便宜的开放权重竞争对手挤压了托管 API 的定价。这些发布也是两家实验室自近期因 AI 安全辩论而呼吁行业普遍放缓以来推出的首批新模型。

OpenAI的GPT-6 Sol/Luna和Anthropic的Opus 5.5将成本削减放在首位

OpenAI在9月22日为其GPT-6系列新增了两个新层级:GPT-6索尔和 GPT-6 Luna。公司表示,新层级削减了API将定价降低50%,与GPT-5.6的促销定价相比,将此举定位为开发者通过编程调用模型所支付费用的直接减少。

细分是明确的。OpenAI将Sol定位为低于Astra的一个层级,旨在处理更复杂的工作负载,如编码。Luna则被框定为“高容量任务”,例如提取信息或总结文档,这类工作通常需要大量的吞吐量,基于代币的API费用可能会主导单位经济。

Anthropic的发布从不同的角度触及了同一个杠杆。该公司推出了Claude Opus 5.5,作为其Claude 5.5系列中的最新模型,并将其描述为更具令牌效率,估计运行成本比Opus 5低约40%。令牌是模型处理的文本块,令牌效率很重要,因为大多数API定价是按进出令牌计费的。

Anthropic的产品负责人Dianne Penn将这一机制描述为减少模型在给定“努力设置”下完成相同工作的所需令牌数量。Penn表示:“我们正在不断创新的一件事是如何使这种思维、如何使回答更加高效,以便根据你的努力设置使用更少的令牌。”

这两次发布都在相同的竞争背景下进行:来自更便宜的开放权重模型的压力,这意味着这些模型的权重可以供他人运行或微调,而不是被锁定在托管的API后面。在这种情况下提到的竞争对手包括阿里巴巴、Moonshot AI和DeepSeek。

时机也很重要。这被描述为这两个实验室自最近安全辩论加剧以来的首次发布,业界普遍呼吁放慢开发先进AI的步伐。Anthropic首席执行官达里奥·阿莫代(Dario Amodei)在最近几周呼吁放慢速度,OpenAI首席执行官山姆·阿尔特曼(Sam Altman)和埃隆·马斯克(Elon Musk)也加入了这一呼吁。安全辩论部分是由前Anthropic研究员雅各布·考克森(Jacob Coxon)在9月8日的X帖子中引发的,他表示自己辞职,并警告称这两个实验室正在“拿我们的生命冒险”。

交易者可以监控的下一步:定价表、基准和开放权重溢出

直接的限制是披露信息是方向性的,而不是完全定价的。OpenAI和Anthropic提供了百分比的减少,但提供的文本中并不包括绝对的API定价表,例如输入和输出的$/1M代币,或关于这些削减是否在上下文窗口、工具使用或更高努力推理模式中均匀适用的任何细节。

基准是下一个缺失的基本要素。如果没有第三方对GPT-6 Sol/Luna和Claude Opus 5.5与之前版本以及所提到的开放权重竞争对手的比较,市场就只剩下一个成本曲线信号,而没有量化的每美元性能差异。

采用是另一个关键。如果Luna确实针对“高容量任务”进行了调整,验证将表现为可测量的吞吐量增长、开发者迁移或在提取和总结工作负载中的使用集中度,其中开放权重的部署可以削弱托管API。摘录中没有提供使用指标,因此任何下游对计算需求的推测仍然是猜测。

最后,这些发布为减速言论设定了一个短期的可信度测试。领导层关于最近的呼吁是否会改变发布节奏或施加部署限制的后续声明将比头条折扣更为重要,因为节奏和限制决定了更便宜的前沿推理实际传播到生产工作负载的速度。

我的看法:更便宜的前沿API提高了“AI代币”叙事的门槛,而没有新的证明点。

这里的机制很简单:这两个实验室都试图通过降低有效运行成本来保护推理量,或者通过明确的API降价(OpenAI的50%与GPT-5.6促销定价相比)或通过将代币效率营销为“相同工作,较少代币”(Anthropic的约40%更便宜的运行声明)。这看起来不像是一次性促销,更像是针对成本敏感用例的细分,特别是在高吞吐量的提取和总结领域,如果你能操作堆栈,开放权重模型可以便宜地运行。

重要的门槛是绝对定价表和独立基准是否能迅速到位,以将这一叙事转变为可测量的每美元性能重置。如果数字和采用数据确认更便宜的层次将真实工作负载从开放权重部署中拉回,那么实际影响就是推理定价的底线降低,迫使每个与AI相关的代币故事必须用使用情况而非口号来证明自己。

来源