據媒體報道,字節跳動正在討論訓練一個參數規模超過 5 萬億的模型——這個數字壓過了阿里 Qwen 3.8-Max 的 2.4 萬億和月之暗面 K3 的 2.8 萬億,是目前國內已知參數規模最大的模型。該計劃仍處早期階段,模型最終不一定會發布。新模型由 Seed Foundation 負責人項亮牽頭,與大語言模型預訓練數據負責人沈科合作,Seed 正爲此重新梳理組織、劃分職責、分配資源。接近 Seed 的人士給出的理由很直白:與其在現有尺寸上繼續追趕其他大模型,不如把參數規模一次推到同行的數倍,爭取領先位置。
這背後是字節高層一連串明確表態。創始人張一鳴在近日的內部會議中罕見表態:做模型要堅持長期主義、延遲滿足感,而不是用別人的輸出去換一時的榜單排名。他明確指出,字節應該願意爲長期目標犧牲一部分短期收益。更狠的是,目前字節內部對開源模型嚴禁蒸餾,甚至通過 API 檢測等方式加強限制——張一鳴認爲,蒸餾會干擾真正意義上的長期技術突破。
8 月 6 日的 2026 年中全員大會上,CEO 梁汝波又把這套邏輯講了一遍。他表示在大語言模型上字節會繼續堅持自研、做好基本功,接受短期落後,堅持優化長期。所謂優化長期,就是以用戶和增量社會價值爲中心,不爲短期波動所動;落到 AI 業務,就是相信 AGI、堅持自研。他特意澄清:"昨天有外部報道說,我們是因爲外部壓力才堅持自研的,這是瞎猜。真實原因是希望團隊延遲滿足感,打好技術基礎,這對長期實現 AGI 很關鍵。"
從張一鳴到梁汝波,這次高層接連發聲不是單純的技術規劃,而是一次完整的戰略宣告:對內統一研發思路,對外釋放信號——字節無意跟隨旁人技術路線內卷,打算走出一條屬於自己的成長曲線。
