8月13日,

該功能由 OpenAI 聯合芯片廠商 Cerebras 共同開發,目前處於預覽階段,優先向部分企業客戶開放,後續將隨算力擴容逐步擴大覆蓋範圍。
傳統大模型應用長期受制於“模型能力”與“響應速度”的妥協,實時場景往往被迫選用小參數模型。Ultrafast 模式的落地打破了這一困局,使 GPT-5.6Sol 能無縫部署於事件響應、客戶服務、金融市場分析及電子商務等對時延極度敏感的複雜工作流中。
相較競爭對手 Anthropic 旗下的 Claude 快速模式,OpenAI 在輸出吞吐量與執行效率上展現出更強優勢。這一技術突破標誌着前沿大模型正在加速從“高延遲離線推理”邁向“高吞吐實時交互”,未來將重塑企業級 AI 的落地形態與生產力標準。
