据媒体报道,字节跳动正在讨论训练一个参数规模超过 5 万亿的模型——这个数字压过了阿里 Qwen 3.8-Max 的 2.4 万亿和月之暗面 K3 的 2.8 万亿,是目前国内已知参数规模最大的模型。该计划仍处早期阶段,模型最终不一定会发布。新模型由 Seed Foundation 负责人项亮牵头,与大语言模型预训练数据负责人沈科合作,Seed 正为此重新梳理组织、划分职责、分配资源。接近 Seed 的人士给出的理由很直白:与其在现有尺寸上继续追赶其他大模型,不如把参数规模一次推到同行的数倍,争取领先位置。
这背后是字节高层一连串明确表态。创始人张一鸣在近日的内部会议中罕见表态:做模型要坚持长期主义、延迟满足感,而不是用别人的输出去换一时的榜单排名。他明确指出,字节应该愿意为长期目标牺牲一部分短期收益。更狠的是,目前字节内部对开源模型严禁蒸馏,甚至通过 API 检测等方式加强限制——张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。
8 月 6 日的 2026 年中全员大会上,CEO 梁汝波又把这套逻辑讲了一遍。他表示在大语言模型上字节会继续坚持自研、做好基本功,接受短期落后,坚持优化长期。所谓优化长期,就是以用户和增量社会价值为中心,不为短期波动所动;落到 AI 业务,就是相信 AGI、坚持自研。他特意澄清:"昨天有外部报道说,我们是因为外部压力才坚持自研的,这是瞎猜。真实原因是希望团队延迟满足感,打好技术基础,这对长期实现 AGI 很关键。"
从张一鸣到梁汝波,这次高层接连发声不是单纯的技术规划,而是一次完整的战略宣告:对内统一研发思路,对外释放信号——字节无意跟随旁人技术路线内卷,打算走出一条属于自己的成长曲线。
