字节跳动张一鸣拒走捷径 强调「长期主义」不用AI蒸馏换取一时排名

撰文: 郑宁
出版:更新:

面对全球的AI大模型竞争进入白热化阶段,字节跳动(ByteDance)创办人张一鸣日前在内部会议上罕有表态,明确拒绝走“模型蒸馏”的技术捷径以提升AI模型能力,而这意味著字节旗下的“豆包”(Seed团队旗舰模型家族)在一段时间内可能落后于国内竞争伙伴。据悉,字节跳动内部已严禁蒸馏开源模型,甚至透过API检测等手段加强技术限制,强调做模型要坚持长期主义与第一原理。

字节跳动官网_张一鸣

据美媒《The Information》及陆媒《澎湃新闻》报道,张一鸣在上月召开的Seed团队全员大会上罕见表态,在其他负责人讨论“公司为何不利用蒸馏抢占先机”时,张一鸣明确指出,做模型必须坚持长期主义与延迟满足感,而不是依靠其他模型的输出来换取一时的榜单排名,字节跳动“应该愿意为长期目标牺牲一部份短期收益”。

“蒸馏”(或称数据提炼),即是指利用更强大的前沿模型(通常是非自身构建的模型)所输出的数据来训练自家模型。这种方法能大幅节省训练时间与算力开销,但其技术路径在业界备受争议。

字节跳动标志(Reuters)

国内开源模型逼压 是否使用AI蒸馏内部争论久矣

据字节跳动员工透露,Seed团队内部对于是否应转向“蒸馏”的争论由来已久。今年以来,国内同行开源模型的快速进步给字节跳动带来巨大压力,每当市场出现强大的新开源模型时,内部关于蒸馏的讨论便会升温。

此外,字节跳动也是内地主要AI企业中,极少数大语言模型几乎全部为专有模型、而非专注于开源模型的企业,不愿使用蒸馏被认为是其模型目前暂时落后于国内其他AI实验室的原因之一。

2026年3月12日,字节跳动的豆包AI大型模型在中国上海亮相。(Getty)

另外,据《南华早报》报道,近年保持低调的张一鸣一直深度参与Seed团队的核心技术评审,甚至深夜研读OpenAI的学术论文。张一鸣认为,蒸馏会干扰真正意义上的长期技术突破。为贯彻此原则,字节跳动内部除了明令禁止蒸馏开源模型外,更进一步通过API检测等方式监控与限制相关行为。