在字节跳动的大模型攻坚战上,张一鸣定下一条硬规矩:不靠蒸馏别人来变强。 据The Information报道,8月5日披露,张一鸣在Seed全员会上明确表示,即使字节的大模型暂时落后,也不能依赖蒸馏其他公司的前沿模型来提升能力。此时,中国大模型行业正激烈竞争,蒸馏被许多团队视为追赶的最快路径,但张一鸣主动堵上了这条路。 所谓蒸馏,简单说就是让自家模型“拜师”更强模型,学习它的输出与解题方式。这项技术早在2015年就由“深度学习之父”杰弗里·辛顿系统推广,过去多用于压缩模型、降低成本。但在ChatGPT之后,最先进的大模型成了各家公司核心资产,蒸馏也牵扯到知识产权、技术原创与中美AI竞争。 为什么张一鸣要放弃捷径?据参会员工透露,他希望团队学会延迟满足,把基本功打牢。字节跳动的CEO梁汝波也在8月6日的全员会上回应了外部猜测——有人将这一决定归因于TikTok在美国面临的风险,梁汝波直接说“瞎猜”。他承认字节的大语言模型目前确实落后,与海外领先模型的差距还在扩大,但坚持自研不是为了应付外部压力,而是不想让Seed习惯站在别人铺好的路上。 张一鸣真正担心的是:如果今天学Claude,明天追GPT,后天又追一个新模型,字节或许能成为很强的追赶者,却很难成为第一个提出新问题的人。所以即便速度慢下来,也要让团队自己找路。 实际上,这不是张一鸣第一次坚持“从零学起”。2012年,今日头条刚起步时,团队讨论是否要做个性化推荐引擎,有人担心“我们没有推荐的基因和能力”,张一鸣的回答是:“推荐我们不会,但可以学啊。”后来,字节从零学习算法,打造出今日头条和抖音。他后来总结为“大力出奇迹”——产品先上,数据说话,快速试错,持续迭代。 但到了2021年,张一鸣却承认自己“跟不上了”。那年5月,38岁的他卸任CEO,在内部信中说自己过去几年很大程度上在“吃老本”,已经很少有时间系统学习,甚至在技术讨论会上都很难跟上。他决定以十年为期,腾出更多时间学习、思考和研究。在外界看来这像退场,五年后再看更像换位:梁汝波接手日常经营,张一鸣则把精力投向AI和前沿技术。 据《The Information》报道,如今张一鸣大约一半的工作时间都花在Seed上,但他在内部会议上很少主动表态,更多是听和追问。直到2026年7月,当团队再次讨论是否靠蒸馏追赶对手时,他才罕见开口,拍板拒绝了这条近路。字节内部甚至对利用其他开源模型蒸馏同样严格限制,还会通过API检测管控。 “为了实现长远目标,我们应该愿意牺牲一些短期利益。”张一鸣的选择,意味着字节的AI大模型得从头探索自己的路。这也许会让字节暂时慢一些,但在他眼中,比永远跟在别人身后更重要。

打开网易新闻 查看精彩图片