🤖 人工智能 · 大模型 · 字节跳动

🔥 张一鸣明确表态,不靠蒸馏别人模型走捷径,坚持从头训练,把技术根基握在自己手里。

一、拒绝捷径,字节选择硬啃底层

近期,字节跳动创始人张一鸣就大模型发展路径作出明确表态:字节的大模型拒绝模型蒸馏这条捷径,而是要踏踏实实把底层能力做扎实。“模型蒸馏”本是行业里常见的手段,用一个大模型的输出去训练另一个更小的模型,能快速起效、省下大量算力成本。但张一鸣的态度很直接——这条看似省力的路,字节不打算走。

在百模大战退潮、行业转入“精算时代”的当下,这一表态显得格外硬气。越来越多厂商开始算成本账,靠融资补贴的路子难以为继,而字节反其道行之,把重心放在原创训练上,赌的是长期的技术壁垒。

二、值不值的账,字节算得很清楚

从商业账面上看,蒸馏确实是“快钱”:拿成熟模型的输出做监督信号,训练周期和硬件投入都能砍下一大截。但快钱背后是隐患重重——蒸馏出的模型上限被“老师模型”锁死,遇到从未见过的难题容易露怯,更关键的是,这种捷径会让人在底层能力上长期“断奶”

字节的逻辑不难懂:大模型是未来十年的基础设施,一旦在根基上偷懒,后面所有上层应用都会被天花板卡住。与其追一时的高低分,不如把训练数据、算力调度、算法框架这些“内功”一点点练出来。这也解释了字节为何持续加码自研,而非简单复用别人家开源模型。

三、慢即是快,考验的是定力

拒绝捷径,意味着更高的成本、更长的周期,以及短期内可能并不亮眼的榜单排名。这条路的压力肉眼可见:人才、算力、数据,每一项都是真金白银的持续投入。但张一鸣的判断很清醒——真正的护城河从来不是“抄近道”能砌出来的

放到整个行业来看,字节的表态也像是一面镜子:当价格战告一段落、价值战拉开序幕,究竟是拼短期跑分还是拼底层能力,成了每家大厂必须回答的命题。字节这次给出的答案,是选择那条更难、但天花板更高的路。

综合金融时报、第一财经等报道 | 2026-08-21