OpenAI 史上最快的模型,死了。Codex 負責人 Tibo 發帖宣佈,GPT-5.3-Codex-Spark 下週退役。這款每秒 1200 個 Token、OpenAI 第一個逃離英偉達的模型、750 兆瓦 Cerebras 大單的第一份交付,從發佈到下線只活了 7 個月。Tibo 給的理由很簡單:用量一直在往下掉,手上也已經有明顯更好的模型了,“是時候給未來騰地方了”。他還補了一刀:“真不敢相信,我們居然發佈過名字這麼長的模型!!”
從“未來”到邊緣化,敗在“降智提速”
今年 2 月 12 日 Spark 上線時排場盛大:這是 OpenAI 第一個專爲實時編程設計的模型,128k 上下文,每秒生成超過 1000 個 Token,官方稱往返開銷降 80%、首 Token 延遲砍半。它還是 OpenAI 第一個跑在英偉達技術棧之外的生產模型,底層算力來自 Cerebras 的晶圓級芯片 WSE-3,標誌着那份 750 兆瓦、總價值超 200 億美元算力大單交出了第一份答卷。
但熱度退得比漲得更快。Spark 的致命傷在於,一塊晶圓裝不下旗艦模型,它本質上是一個爲極致速度而妥協的“蒸餾版小模型”:Terminal-Bench 2.0 評測中僅 58.4%,遠低於完整版 GPT-5.3-Codex 的 77.3%;SWE-Bench Pro 曲線顯示它雖能把任務壓到 1 至 2 分鐘,準確率卻停在 47% 至 51%,而完整版從 3 分鐘的 51% 可拉到 16 分鐘的 57%。宣傳中的“15 倍提速”也被拆穿——同等準確率下其實只快 1.37 倍。開發者吐槽它憑空捏造 API 端點、JSON 格式不穩定,培訓機構 Turing College 的總結一針見血:“沒有智能的速度,只是更快地失敗。”
真正給 Spark 判死刑的是 8 月 13 日 Cerebras 發佈的 Ultrafast 模式:跑在晶圓上的不再是縮水版,而是旗艦模型 GPT-5.6 Sol 本尊。通過將旗艦模型按層切分、鋪設在多臺 CS-3 節點上形成流水線,Ultrafast 在“與標準版同等智能”前提下飆出每秒 750 個 Token——同一任務標準檔平均 7.7 分鐘,Ultrafast 僅 83 秒,端到端快 5.6 倍。Cerebras CEO Andrew Feldman 稱:“速度與智能,不再互斥。”
速度從“專屬模型”變成“付費檔位”
Spark 並非唯一被清理的歷史包袱。過去三個月 OpenAI 模型庫經歷激進換血:6 月 2 日 GPT-5.2 與 GPT-5.3-Codex 退役,8 月 31 日 GPT-5.4 與 5.4 Mini 退役、用戶整體遷移至 5.6 世代,9 月 11 日輪到 GPT-5.3-Codex-Spark。伴隨舊世代離場,Codex 迎來了 Sol、Terra、Luna、Astra 的全新命名紀元。
更深層的邏輯更迭在於,“快”正從一個獨立的專用模型,演變爲旗艦模型的一項標配檔位——就像推理強度分爲 Light 到 Max,速度也從 Standard、Priority 排到 Ultrafast,按檔付費的商業模式已經跑通。回頭看,Spark 作爲過渡期的探路者,證明了 Cerebras 晶圓足以扛住生產級流量、推理任務可以脫離英偉達生態運行;當探路結束、大部隊入駐,探路者的使命也就自然終結。下一輪競賽比的不再是誰能做出最快的閹割版模型,而是誰能把最強的旗艦模型跑出最極限的速度。
VIP會員