产品更新 · OpenAI News
OpenAI推出Ultrafast模式:GPT-5.6 Sol推理速度提升14倍
OpenAI今日发布公告,预览全新的API服务层Ultrafast模式,该模式可让GPT-5.6 Sol模型以最高14倍的速度运行,输出速率最高达每秒750个token。该服务由AI芯片公司Cerebras提供算力支持,旨在满足对低延迟、高吞吐量推理有严格要求的应用场景。OpenAI表示,Ultrafast模式目前处于预览阶段,具体上线时间、定价及可用区域尚未公布,实际性能可能依负载和网络状况而波动。这一举措标志着OpenAI在推理性能优化上的新方向,也可能对AI应用开发成本与响应体验产生重要影响。
原文:OpenAI News原文发布:2026/8/13 10:00:00中文发布:2026/8/13 17:00:10
OpenAI于今日发布预告,宣布正在预览一项名为Ultrafast的新API服务层级,该服务专为追求极致推理速度的场景设计。据官方介绍,Ultrafast模式下,GPT-5.6 Sol模型的运行速度可达到标准配置的14倍,输出速度最高可提升至每秒750个token。这一性能突破主要得益于与AI芯片公司Cerebras的合作,后者为OpenAI提供了专用算力基础设施。
OpenAI在公告中强调,Ultrafast模式主要面向对延迟极为敏感的实时应用,例如智能客服、代码补全、实时翻译以及大规模并发生成任务。当前,该模式仅作为技术预览开放,意味着其功能、稳定性及接口规格仍可能发生变化。OpenAI并未透露正式商用版本的具体时间表,也未公布任何定价细节,同时表示实际吞吐量可能受网络状况、提示词长度和API调用负载等因素影响。
从行业角度看,这并非简单的速度优化,而是可能重塑AI应用经济性的关键一步。更快的推理速度意味着单位时间可处理更多请求,从而降低单次调用成本,同时也为更复杂的实时交互产品创造了可能性。Cerebras作为定制AI硬件厂商,其超大规模芯片在此次合作中扮演了重要角色,这或许预示着OpenAI将继续探索多元化的算力合作伙伴,以降低对单一GPU供应商的依赖。
不过,外界仍需保持谨慎:目前所披露的数据均基于预览环境,真实生产环境的表现尚未有第三方验证。此外,OpenAI并未说明Ultrafast模式是否会对所有开发者开放,或是否仅限特定合作企业使用。考虑到GPT-5.6 Sol本身仍处于迭代之中,这一新服务最终的性能表现和价值仍有待观察。
#OpenAI#GPT-5.6#Ultrafast#Cerebras#推理速度#API
查看原始信息来源