字节年中全员会定调:承认大模型暂时落后坚持自研,张一鸣拒绝蒸馏捷径

首页 / AI资讯 / AI大厂

0:00
0:00
1x
定时

一场内部会议,把字节跳动在AI浪潮中的战略底牌亮了出来。8月6日,字节跳动召开2026年度年中全员会,CEO梁汝波对AI业务上半年表现做了复盘,其中最受关注的一句话是:视频生成模型Seedance保持了SOTA地位,豆包在C端具备竞争力,但大语言模型被海外拉开差距,公司决定坚持自研、接受短期落后。与此同时,创始人张一鸣在内部会议罕见表态,做模型要坚持长期主义、延迟满足感,不把蒸馏当作提升能力的捷径,即便暂时落后于国内竞品。

这两条表态放在一起,勾勒出字节对AI业务的整体判断:在视频与多模态赛道继续加码押注,在大语言模型赛道上放弃追赶式的焦虑,转而以更长周期换取真正的技术积累。对于外界持续关注的字节大模型能力问题,这次全员会给出了官方的定性,也回应了此前市场上关于字节是否会用蒸馏方式快速追平的种种猜测。

梁汝波复盘半年成绩单,Seedance为何被单独点名

全员会上,梁汝波对AI各条业务线做了一轮罕见的坦诚盘点。视频生成模型Seedance被他称为保持SOTA的核心资产,这也是字节AI业务上半年最拿得出手的成绩。8月6日当天,字节旗下即梦AI宣布首发接入Seedance 2.5,同步上线Maya、Blender插件以及智能编辑模式,并联合上影等专业机构探索影视级交付。该版本于7月31日发布,重点优化了画质、音质与运动效果,单次生成时长提升至30秒,被视为字节在视频生成赛道上对抗快手可灵、阿里通义万相等竞品的关键武器。

梁汝波同时肯定了豆包在C端的表现,认为其具备竞争力。豆包作为字节面向大众市场的AI助手,凭借庞大的流量入口和丰富的场景整合,用户规模持续扩大,近期还接入原生音视频全双工大模型SeedRealtime,补齐了实时语音交互能力。值得注意的是,他并未回避大语言模型的短板,直言与海外头部模型存在差距,这也印证了外界对字节大模型能力相对薄弱的普遍认知。

在算力层面,字节的投入力度并未因模型短板而收缩。作为国内少数拥有万卡级训练集群的公司,字节在算力基建上的持续投入,为Seedance等模型的迭代提供了基础保障。梁汝波的定调意味着,字节不会因为短期落后而收缩AI投入,反而会以更聚焦的方式把资源集中到自身具备优势的赛道。

张一鸣拒绝蒸馏捷径,坚持长期主义的底气从哪来

如果说梁汝波的表态是战略层面的定调,张一鸣的表态则是方法论层面的校准。他在内部会议中明确表示,不把蒸馏当作提升能力的捷径,即便暂时落后国内竞品也要坚持长期主义与延迟满足感。所谓蒸馏,是指用强模型生成的数据训练弱模型,从而以较低成本快速逼近强模型能力的技术路线。国内多家厂商曾借助这一方法快速提升模型表现,市场也因此一度传言字节会采用类似策略加速追赶。

张一鸣的拒绝,本质上是对技术路线的选择:蒸馏可以快速拉平基准分数,但无法建立底层创新能力,一旦头部模型迭代到新架构,依赖蒸馏的团队会再次落后。这一判断与字节在视频模型上的投入逻辑一脉相承,Seedance之所以能保持SOTA,靠的正是对底层模型架构和训练方法的持续钻研,而非短期取巧。

当然,坚持自研也意味着字节要承受追赶成本。大语言模型的训练周期长、算力投入大,短期内字节在通用对话场景的体验可能仍与头部竞品存在差距。但从产业史看,字节曾经以同样的耐心在推荐算法上完成过从追赶到领先的过程,管理层显然希望将这套方法论复制到AI领域。延迟满足感的背后,是字节对AI长期价值的判断:真正的壁垒不在榜单分数,而在工程体系、数据飞轮和产品生态。

豆包与SeedRealtime,字节C端AI的差异化打法

在大模型暂时落后的背景下,豆包被梁汝波点名为C端具备竞争力的产品,背后是字节特有的打法。豆包没有选择与头部模型硬拼通用推理能力,而是依托字节庞大的流量入口和内容生态,把AI能力嵌入用户高频使用的场景之中。近期豆包接入原生音视频全双工大模型SeedRealtime,补齐了实时语音交互能力,用户可以像与人对话一样与豆包自然交流,这一体验直接对标海外头部语音助手,成为豆包差异化的关键抓手。

SeedRealtime的价值在于,它把多模态交互从"你一句我一句"的回合制,推进到可打断、可插话的实时全双工模式,更接近真实对话的节奏。配合字节在内容推荐上的深厚积累,豆包能根据用户画像推荐更贴合需求的服务,这种场景理解能力是单纯比拼模型分数无法覆盖的。对于字节而言,豆包的定位更像是AI能力进入大众生活的入口,即便底层模型还在追赶,只要入口体验保持领先,就仍有翻盘的机会。

不追蒸馏只追架构,字节AI能否等来自己的拐点

字节这次全员会的表态,在业内引发的讨论远超一场内部会议本身。支持者认为,字节拥有国内顶级的内容生态、流量入口和算力储备,坚持自研大模型虽然短期承压,但长期胜算更高;质疑者则指出,大模型竞争是典型的赢家通吃格局,落后窗口期越长,追赶难度越大,完全拒绝蒸馏可能导致字节在关键能力上持续掉队。

从产业视角看,字节的处境其实反映了中国AI大厂在模型路线上的分化。一部分厂商选择快速迭代、以开源和性价比抢占市场,另一部分则像字节一样押注长期自研,把资源集中到自身最擅长的视频多模态方向。两种路线并无绝对优劣,关键在于与自身业务结构的匹配度。字节的核心营收来自内容与广告,视频生成、多模态理解与这些业务天然协同,而通用对话模型与搜索场景的关联度相对有限。

可以预见,未来一年字节AI业务将呈现明显的结构性特征:视频与多模态赛道持续高投入、高迭代,大语言模型则在自研轨道上缓慢爬坡。Seedance能否在专业级应用中打开商业化空间,豆包能否依托流量优势在C端建立壁垒,将是检验这次战略定调成色的两个关键指标。对于行业而言,字节选择不走捷径的样本价值,也许比它最终交出的大模型成绩单更加值得关注。

素材来源:每日经济新闻、Tech星球、三易生活 发布时间:2026-08-09