即使短期内可能落后于国内竞争对手,字节跳动也明确拒绝将“模型蒸馏”作为提升 AI 能力的捷径。据 The Information 报道,创始人张一鸣在近期内部会议上重申了这一立场,揭示了字节在 AI 发展路线上的核心思考。
据悉,Seed 团队内部关于是否转向蒸馏技术的争论由来已久。随着国内开源模型的快速迭代,每当有强劲的新模型发布,内部关于利用蒸馏技术缩小差距的呼声便会升温。然而,张一鸣罕见地介入讨论并定调:字节应“为长期目标牺牲部分短期收益”,坚持原创技术路线,而非依赖他人输出换取榜单排名。
战略定力:拒绝蒸馏背后的深层考量
字节对蒸馏技术的谨慎态度,常被外界解读为规避地缘政治风险的策略。此前 TikTok 在美国遭遇的监管危机,确实让公司在技术合规上更加敏感。但据独家信息,字节内部严禁蒸馏的对象不仅限于美国前沿模型,同样包括国内开源模型,并通过 API 检测等手段强化执行。
核心原因在于技术路线的判断。管理层认为,过度依赖蒸馏会干扰真正的长期技术突破。在张一鸣看来,大模型研发需秉持长期主义与延迟满足,不能因一时的榜单名次而偏离自主创新轨道。
行业背景:中美博弈下的技术争议
近期,月之暗面发布的 Kimi K3 因性能逼近美国顶尖模型引发白宫关注,美方官员指责其通过蒸馏美国模型提升能力。所谓“蒸馏”,即利用先进模型的输出结果训练新模型。这一指控使得模型蒸馏成为中美 AI 竞争中的敏感话题。
Anthropic 曾指控多家中国公司违规提取 Claude 能力,但并未点名字节跳动。尽管部分观点认为蒸馏是中国模型快速进步的关键,但不少美国开发者也承认,中国企业在架构创新(如 DeepSeek 降低显存消耗)等方面已形成独立技术能力,仅靠蒸馏无法解释其整体表现。
现状对比:闭源策略与市场挑战
在中国主要 AI 厂商中,字节跳动显得尤为特殊:其大语言模型基本采取全闭源策略,而其他头部企业多侧重开源。由于缺乏公开评测数据,加之云业务市场份额相对较小,外界难以准确评估字节模型的真实水平。
目前,字节旗舰模型 Seed 2.1 Pro 未收录于主流排行榜 Artificial Analysis,在 Arena AI 编程榜单中仅列第 19 位,明显落后于阿里、智谱等竞品。部分员工坦言,拒绝蒸馏或许是导致其大语言模型暂时落后的原因之一。
值得注意的是,在 AI 视频生成领域,凭借 Seedance 2.0 的突破性表现,字节已确立全球领先地位。这表明,坚持自主研发虽在大语言模型赛道面临阵痛,但在特定垂直领域已显现成效。
对于急需追赶的企业而言,蒸馏确能缩短周期、降低成本。但经历 TikTok 风波后,字节在技术选型上已不再单纯唯榜单论。选择不走“近路”,意味着其大模型业务需承受更长的沉淀期,但这也被视为构建长期护城河的必经之路。

