8月13日,

该功能由 OpenAI 联合芯片厂商 Cerebras 共同开发,目前处于预览阶段,优先向部分企业客户开放,后续将随算力扩容逐步扩大覆盖范围。
传统大模型应用长期受制于“模型能力”与“响应速度”的妥协,实时场景往往被迫选用小参数模型。Ultrafast 模式的落地打破了这一困局,使 GPT-5.6Sol 能无缝部署于事件响应、客户服务、金融市场分析及电子商务等对时延极度敏感的复杂工作流中。
相较竞争对手 Anthropic 旗下的 Claude 快速模式,OpenAI 在输出吞吐量与执行效率上展现出更强优势。这一技术突破标志着前沿大模型正在加速从“高延迟离线推理”迈向“高吞吐实时交互”,未来将重塑企业级 AI 的落地形态与生产力标准。
