字节跳动Seed团队近日举行全员大会,张一鸣罕见地公开定调:公司不会将模型蒸馏视为提升AI能力的捷径,哪怕牺牲短期收益,也要坚守长期技术路线。
这一表态的背景颇为严峻。作为国内头部AI厂商中,唯一一家大语言模型几乎全数采用自研专有模型的选手,字节跳动的“全自研”策略在带来独特性的同时,也让模型迭代速度背负了沉重压力。业内观点普遍认为,字节在大语言模型部分场景下落后于竞品,根源正在于其拒绝使用蒸馏技术。
所谓蒸馏,即让新模型直接学习前沿模型的推理步骤,以此大幅削减训练时间与算力成本。当国内同行纷纷借助开源模型实现快速迭代时,蒸馏已成行业标配。字节内部关于“是否转向蒸馏”的争论由来已久:一方主张顺应趋势,以蒸馏加速追赶;另一方则坚持自研,坚信唯有专有模型才能在长远构筑起真正的技术壁垒。
张一鸣此次发声,实质上终结了这场内部拉锯——明确不走捷径。
此举背后的逻辑清晰可见。蒸馏虽高效,本质却是站在他人肩膀上做能力搬运,长期依赖恐削弱自身底层创新力。字节选择全自研,意味着押注更远的未来:以更低的速度、更高的成本,换取对核心技术的绝对掌控。
代价同样真实存在。在开源模型日新月异、对手快速逼近的当下,“慢一步”或许会导致市场份额与用户心智的流失。字节能否扛住压力,用时间换空间,最终让自研路线跑赢蒸馏这条“快车道”,将是接下来最值得观察的焦点。
一言以蔽之:张一鸣借一次罕见表态,将字节跳动的AI战略从“能不能快”拉回至“该不该快”的根本命题上。
