據《晚點 LatePost》報道,字節跳動正在討論訓練一款參數規模超過5萬億的大語言模型,若最終落地,其規模將超過阿里通義千問 Qwen3.8-Max 的2.4萬億參數和月之暗面 Kimi K3的2.8萬億參數,成爲目前國內已知參數規模最大的模型。不過,該項目仍處於早期階段,最終是否正式發佈尚未確定。

報道稱,該模型計劃由字節跳動 Seed Foundation 負責人項亮主導,並與大語言模型預訓練數據負責人沈科合作推進。圍繞這一項目,Seed 團隊正在進行組織調整,包括重新梳理研發職責、優化資源配置,以支持超大規模模型訓練。

資料顯示,項亮與沈科均是字節跳動人工智能和大模型研發體系的重要成員,二人均來自字節核心“搜廣推”技術體系。項亮本科畢業於中國科學技術大學,博士就讀於中國科學院自動化研究所,2016年加入字節跳動,曾負責機器學習中臺 AML 團隊,後擔任豆包大模型 Foundation 團隊負責人。沈科於2018年清華大學畢業後加入字節,目前主要負責大語言模型預訓練數據相關工作。

隨着國內外AI廠商持續擴大模型參數規模,並圍繞訓練數據、算力和基礎架構展開競爭,超大規模模型研發正在成爲頭部企業探索通用人工智能能力的重要方向。字節此次佈局也反映出國內大模型競爭正從應用創新進一步延伸至基礎模型能力建設。