日前,OpenAI正式發佈了全新的GPT-5.6模型家族,包括旗艦款Sol、性能均衡的Terra以及走高性價比路線的Luna。這一代產品不僅在模型能力上實現了跨越,更通過對底層技術棧的深度優化,大幅提升了每 token 的智能效率,在降低成本的同時帶來更強勁的性能表現。

在覈心能力方面,旗艦模型Sol在開啓最大推理能力時,在相關編碼智能體基準測試中的表現超越了同類競品,而其 API 成本不到對方的一半。同時發佈的Terra智能基準表現與前代相當,但價格直接腰斬;定位最快且最經濟的Luna,其定價更是比Sol低了80%,爲主流開發者和企業提供了豐富的彈性選擇。

image.png

爲了達成如此顯著的效率飛躍,OpenAI技術團隊對整體技術棧進行了全方位重構。首先在推理環節,通過精細化負載均衡、推測解碼、緩存優化以及自主編寫的高效 GPU 內核,使端到端服務成本進一步下降,並將 token 生成效率提升超過15%。其次,在智能體編排層(agentic harness)設計上,系統通過延遲發現機制有效避免了上下文膨脹,並通過嚴格遵循僅追加的對話歷史管理,大幅增強了提示詞緩存命中率。

image.png

業內分析認爲,GPT-5.6的推出不僅標誌着大模型在算力受限背景下向“極致效率”的集體轉身,也將通過更具性價比的部署方案,加速推動人工智能在各類複雜應用場景中的規模化落地。