字节跳动Seed团队近日举行全员大会,张一鸣罕见地公开定调:公司不会将模型蒸馏视为提升AI能力的捷径,宁可牺牲短期收益,也要坚守长期技术路线。
这一表态的背景颇为严峻。在国内头部AI企业中,字节跳动是唯一一家大语言模型几乎全量采用自研专有模型的厂商。但这种“全自研”策略也让其在模型迭代速度上背负了沉重压力。业界普遍观点认为,字节的大语言模型在部分场景下落后于竞品,根源正在于其拒绝使用蒸馏技术。
所谓蒸馏,是指让新模型直接学习前沿模型的推理步骤,从而大幅削减训练时间与算力开销。在国内竞品借助开源模型快速迭代的当下,蒸馏已成行业标配。字节内部关于“是否转向蒸馏”的争论由来已久:一方主张拥抱趋势,以蒸馏加速追赶;另一方则坚持自研,坚信唯有专有模型才能构筑真正的技术壁垒。
张一鸣此番发言,实质上为这场内部拉锯战画上句号:拒绝走捷径。
背后的逻辑清晰可辨。蒸馏虽高效,本质却是依附于他人模型能力的“搬运”,长期依赖恐削弱自身底层创新能力。字节选择全自研,意味着押注更远的未来——以更低的速度、更高的成本,换取对核心技术的绝对掌控。
代价同样真实存在。在开源模型日新月异、竞品飞速追赶的格局中,“慢一步”或许会导致市场份额与用户心智的流失。字节能否扛住压力,用时间换空间,最终让自研路线跑赢蒸馏的“快车道”,将是接下来最引人注目的看点。
一言以蔽之:张一鸣借一次罕见表态,将字节跳动的AI战略从“能不能快”拉回了“该不该快”的根本命题上。








