新芒xAI 7月31日消息,OpenAI宣布优化GPT-5.6系列模型的定价和性能,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna价格下调80%,GPT-5.6 Terra价格下调20%;相关调整也将反映在Codex和ChatGPT Work的付费订阅额度计算中。
与此同时,OpenAI在API中推出Fast模式,取代此前的Priority Processing服务。GPT-5.6 Sol在Fast模式下的处理速度最高可提升至标准模式的2.5倍,价格为标准处理模式的两倍,模型能力保持不变。这意味着OpenAI正在把GPT-5.6系列拆分成更清晰的成本、速度和能力组合。
关键要点
- Luna和Terra进入降价周期。 Luna降价幅度达到80%,Terra降价20%,显示OpenAI正在通过效率优化降低中低成本模型使用门槛。
- Fast模式替代Priority Processing。 新模式用更高价格换取更快响应,适合对延迟敏感的企业工作流和高优先级任务。
- 订阅额度计算同步调整。 降价将影响Codex和ChatGPT Work中的付费额度消耗,有助于提高企业用户在开发、办公和自动化场景中的可用量。
- 模型定价竞争继续加剧。 在开源模型、国内外低价API和企业成本审查压力下,前沿模型公司必须持续提高每美元智能产出。
新芒xAI评论
OpenAI此次降价的信号很直接:前沿模型竞争已经从单纯拼能力,进入能力、价格、速度和配额体验的综合竞争。对企业来说,模型再强,如果单位调用成本过高,就很难进入高频业务流程;降价后的Luna和Terra更适合承担大量日常推理、代码辅助和企业自动化任务。
Fast模式则说明,OpenAI正在把“速度”产品化。过去用户更多按模型能力付费,现在企业会按任务要求选择:低成本模型处理大规模常规任务,高能力模型处理关键任务,Fast模式处理时间敏感任务。这种分层会让AI预算管理更精细,也会让模型调度成为企业AI应用的重要能力。
更大的行业影响在于,模型价格下行会倒逼所有AI服务商重新计算商业模式。只有推理效率、基础设施利用率和产品黏性同步提升,降价才会变成扩大市场的手段,而不是单纯压缩利润率。