首页 / 人工智能 / AI模型与技术

OpenAI 调整 GPT-5.6 价格性能组合,Sol Fast mode 提供更快处理

OpenAI 更新 GPT-5.6 的 API 服务组合:Sol Fast mode 最高可达标准处理2.5倍速度,Terra 与 Luna 同步调整定价。本文梳理这一分层服务动作及其行业传导。

今日科技圈头条C编辑部已完成来源核验
查看行业与公司影响↓

OpenAI 在7月30日的产品公告中更新了 GPT-5.6 的价格性能组合。公告称,GPT-5.6 Sol 的 API Fast mode 最高可提供标准处理2.5倍的速度,价格为标准处理的两倍,模型智能水平不变。此前标记为 priority 的 API 请求将继续兼容,并自动使用 Fast mode。与此同时,OpenAI 还公布了 Terra 与 Luna 的新 API 定价。

按公告列出的价格,Terra 调整为每百万输入词元2美元、每百万输出词元12美元;Luna 调整为每百万输入词元0.20美元、每百万输出词元1.20美元。Sol 的定价保持不变。此次调整并非以单一模型覆盖所有工作负载,而是把任务对速度、能力和成本的不同要求拆分为可选择的服务档位。

Fast mode 是 API 的处理选项,不等同于模型能力升级,也不意味着所有用户都会获得相同的端到端响应时间。请求长度、并发、工具调用以及应用自身架构都会影响实际延迟。公告未披露此次调整对应的收入、客户数量或算力规模,因此不宜据此延伸经营层面的结论。

上述内容仅整理已公开披露的时间、主体、动作与尚未披露的边界。

AI推理服务开始更明确地区分时间与成本

对企业软件和开发者而言,响应时间要求较高的任务可采用更高价格的处理档位,后台或非实时任务则可继续按成本优先的模型和配置安排。这样的分层让应用能够按具体工作流配置推理预算,也使响应时间成为更明确的产品服务维度。对推理基础设施而言,低延迟档位会强化容量调度与峰值资源管理的重要性,但服务需求和营收规模仍不能仅由这次定价调整推导。实际影响取决于开发者对不同档位的采用,以及应用场景对速度和成本的取舍。

涉及行业行业影响分析简要理由
AI模型服务利好速度、能力与价格分层使开发者可按工作流选择服务档位。
应用软件中性更快处理有助于实时场景,但实际收益取决于应用采用与成本预算。
互联网服务与基础设施中性低延迟档位强化资源调度需求,具体容量与营收未披露。

新闻热点内容来源于媒体公开报道。文章分析仅代表个人观点,不构成投资建议。

专题:AI模型与技术

#OpenAI#GPT-5.6#AI推理#模型API