8月13日,OpenAI發佈全新“Ultrafast”(超快)運行模式,顯著提升其最新旗艦大模型 GPT-5.6Sol 的處理效率。官方數據顯示,在保持模型原有高水平智能與輸出質量的前提下,Ultrafast 模式的運行速度較標準處理提升高達14倍,每秒可生成最多750個輸出標記(Tokens)。

OpenAI

該功能由 OpenAI 聯合芯片廠商 Cerebras 共同開發,目前處於預覽階段,優先向部分企業客戶開放,後續將隨算力擴容逐步擴大覆蓋範圍。

傳統大模型應用長期受制於“模型能力”與“響應速度”的妥協,實時場景往往被迫選用小參數模型。Ultrafast 模式的落地打破了這一困局,使 GPT-5.6Sol 能無縫部署於事件響應、客戶服務、金融市場分析及電子商務等對時延極度敏感的複雜工作流中。

相較競爭對手 Anthropic 旗下的 Claude 快速模式,OpenAI 在輸出吞吐量與執行效率上展現出更強優勢。這一技術突破標誌着前沿大模型正在加速從“高延遲離線推理”邁向“高吞吐實時交互”,未來將重塑企業級 AI 的落地形態與生產力標準。