字节跳动Seed团队近期举行全员大会,张一鸣罕见地公开定调:公司不会将模型蒸馏视为提升AI能力的捷径,哪怕牺牲短期利益,也要坚守长期技术路线。
这一表态的背景略显沉重。在国内头部AI厂商中,字节跳动是唯一一家大语言模型几乎全由自研专有模型构成的企业。这种“全自研”策略虽独特,却也令其在模型迭代速度上承压不小。业界普遍看法是,字节大语言模型在部分场景下稍逊一筹,根源便在于其拒绝采用蒸馏技术。
蒸馏技术旨在让新模型直接学习前沿模型的推理步骤,能显著缩减训练时间与算力消耗。如今,国内竞品多借开源模型实现快速迭代,蒸馏已成行业惯例。字节内部对于“是否转向蒸馏”的争议由来已久:一派主张顺应趋势,靠蒸馏加速追赶;另一派则坚持自研,认为唯有专有模型才能构建长期的技术护城河。
张一鸣此次发声,相当于给这场内部辩论画上句号:拒绝走捷径。
这一选择的逻辑清晰可见。蒸馏虽高效,本质却是依托他人模型能力进行“搬运”,长期依赖或削弱自身底层创新力。字节选择全自研,实则是押注更远的未来——以较慢的速度、较高的成本,换取对核心技术的绝对掌控。
代价同样真实存在。在开源模型日新月异、对手紧追不舍的背景下,“慢一步”或许意味着市场份额与用户心智的流失。字节能否承受此压力,用时间换空间,最终让自研路线跑赢蒸馏的“快车道”,将是后续最受瞩目的焦点。
简言之,张一鸣通过一次罕见表态,将字节跳动的AI战略从“能否求快”拉回了“该不该快”的本质层面。
