字节跳动Seed团队近期举办了一场全员大会,张一鸣在此次会议中发布了一次公开讲话,其内容颇为引人关注——公司明确表示不将模型蒸馏当作增强AI能力的策略,而是决定牺牲短期盈利,坚定执行长期技术规划。
话语背后的环境却并不乐观。作为国内AI领域领先企业,字节跳动是唯一一家在大语言模型方面完全依赖自研专有技术的公司。不过,这种"完全自研"的模式也给字节在模型更新速度上带来了不小的挑战。业内多数看法指出,字节的大语言模型在某些应用场景中落后于对手,很大程度上是因为它没有采用蒸馏技术。
蒸馏技术指的是让新模型直接学习先进模型推理过程的一种训练手段,能显著降低训练所需的时间和计算资源。在国内竞争对手大多借助开源模型加速开发的情况下,蒸馏几乎已经成为行业普遍采用的方法。字节内部关于"是否应该采用蒸馏技术"的讨论一直持续着——一部分人主张顺应行业趋势,用蒸馏技术来加快进步;另一部分人则坚持自研道路,认为唯有专有模型才能真正建立技术优势。
张一鸣这次的表态,实际上为这场内部讨论画上了结句:公司选择不走捷径。
这个决定背后的考量十分清晰。蒸馏虽然便捷,其本质还是建立在他人模型能力的基础上进行"复制",长期使用可能会削弱自身的核心创新能力。字节跳动选择全面自研,表明它甘愿牺牲速度,追求对核心技术的完全掌控,以此作为长远发展的赌注。
显而易见的是,代价也是必然存在的。在开源模型不断进步、竞争对手迅速追赶的当前形势下,"慢半步"可能导致市场份额和用户认知的下滑。字节能否承受住这种压力,通过时间换取空间,最终让自研路线超越蒸馏技术看似高效的"直道",将是最值得密切观察的焦点。
一句话来说:张一鸣通过一次罕见的表态,使字节跳动的AI战略从"如何加速"转移到了"是否需要加速"的根源性问题上。










网友评论