AREX Feed Article
豆包大模型 2.2 据报推迟发布,字节 Seed 基础模型部门重组为四个一级部门
8 月 30 日独家报道,字节跳动原计划 8 月推出的豆包大模型 2.2 将推迟面世。多位接近字节的人士称,延期是因为字节内部希望通过更充分的预训练和后训练,把编程、工具调用和 Agent 能力拉上去,用更长的研发周期换一次更明显的能力提升。
同一篇报道还披露,8 月 20 日,Seed 基础模型部门迎来一次重大调整:原本按文本、语音、代码、视觉等模态划分的团队,被拆分、重组为 Pretrain Data(预训练数据)、Horizon RL(强化学习)、Product Posttrain-Work(面向办公场景的产品后训练)、Product Posttrain-Chat(面向 C 端用户的产品后训练)四个一级部门。两则消息目前都停留在匿名信源层面,报道中没有字节跳动官方确认或回应的内容。
当晚以「消息称」口径转载了同一报道,信息来源仍标注为白鲸实验室;原报道署名马舒叶、刘培。
延期换的是 Coding:更充分的预训练与后训练
一位接近字节的人士对白鲸实验室解释了 Seed 的处境:「Seed 现在同时面对两件事,一边要推进下一代超大模型,一边又不能停止现有模型的正常迭代。所以,2.2 更像是夹在两代模型之间的一次关键补强。它既不能等到下一代超大模型完成再解决 Coding,也不能再用过去的方式简单迭代一次。」这位接近字节的人士表示,这可能才是这次延期真正值得关注的地方。
Coding 能力跻身第一梯队,是 Seed 团队 2026 年的主要目标之一。白鲸实验室称,字节希望 Seed 模型的 Coding 能力在年底之前能产生类似智谱 GLM-5.2 和 Kimi-K3 的行业冲击力。报道同时点出了字节长期面对的一个困境:一家拥有大量顶尖研究员、充足算力以及 Trae 产品入口的公司,为什么没能让开发者形成「字节的 Coding 模型已经领先」的认知。
为快速提升 Coding 能力,字节明显加快了人员和组织调整,也从其他模型厂商挖来一些人才;7 月有一段时间,字节的模型在 Coding 上几乎每天都有小功能迭代。字节推崇「大力出奇迹」,希望借助高密度人才和资源倾斜快速补齐能力。过去一年,同样的方式让 Seedance 2.0 改写了视频生成模型的格局,字节希望 Seed 的 Coding 能力复现同样的「奇迹」。
8 月 20 日,Seed 基础模型部门一分为四
白鲸实验室给出了四个新一级部门的分工:Horizon RL 负责 RL Scaling、推理模型和视觉推理,同时覆盖 Coding 方向的后训练;Product Posttrain-Work 重点针对办公场景优化模型的 Agentic 能力,包括工具调用、GUI 操作和长任务执行;Product Posttrain-Chat 面向 C 端用户;Pretrain Data 负责预训练数据相关工作。
这轮调整不是第一次曝光。8 月 19 日,称,Seed 基础模型部门成立四个新一级部门:Pretrain Data 由李成刚负责,Horizon RL 由唐晟宇负责,Product Posttrain-Work 由秦禹嘉负责,Product Posttrain-Chat 由原本朱文佳负责的 Application 团队更名而来,四个部门的负责人均向吴永辉汇报;调整公告中的说法是「合并相似工作、减少 overlap(重合),内聚在一起」。
拆成四块的逻辑,对应的是字节 Seed 模型的竞争方向:不仅要推高代码生成能力,还要快速提升长上下文、工具调用、任务规划、错误恢复,以及在几十分钟甚至数小时任务中的持续决策能力。
拒绝蒸馏,参数往 5T/10T 方向追加训练
白鲸实验室报道,字节在模型训练上拒绝「蒸馏」数据,重新做大规模训练本身,这看上去更长期主义,也更容易实现真正的智能上限突破,但技术挑战很大。字节之前还被传出豆包大模型参数往 5T 乃至 10T 的方向追加训练。更早的消息是,字节正在讨论训练参数规模超 5 万亿的模型,超过阿里 Qwen 3.8-Max(2.4 万亿参数)和月之暗面 K3(2.8 万亿参数),为国内已知最大,计划仍处于早期阶段。这条消息同样出自 IT之家此前的报道。
报道还列出了 Seed 需要从底层解决的 Coding 现实问题:什么任务值得训练,怎样生成复杂的 Agent 轨迹,如何验证轨迹质量,怎样设计奖励,以及模型犯错之后如何让它自己纠正。白鲸实验室的判断是,这正是豆包大模型 2.2 需要更多时间训练的原因,2.2 追求的未必是一个更大的模型,而是一种新的训练方法。
过去两个月,国产模型的更新没停过
豆包 2.2 的延期,发生在国产模型更新最密集的窗口。白鲸实验室梳理了过去两个月的节奏:Kimi 更新 K3,智谱发布 GLM-5.3,千问迭代 Qwen3.8,腾讯混元 8 月底推出 Hy4 preview。在对手接连上新的时候,字节放慢了更新节奏。
张一鸣和梁汝波先后为「自研」定调
「不依赖蒸馏」的路线,此前已由字节两名最高层先后定调。据 IT之家转述 The Information 8 月 5 日的报道,字节跳动创始人张一鸣在 Seed 团队全体会议上明确表示,即使意味着暂时落后于竞争对手,公司也不会依赖 AI 蒸馏技术来改进模型。8 月 6 日,字节跳动 CEO 梁汝波在 2026 年度年中全员会上表示,在大语言模型上,字节跳动接下来还是会坚持自研、做好基本功,接受短期落后,坚持优化长期。
截至发稿,白鲸实验室的报道没有给出豆包大模型 2.2 的新发布时间,延期与重组也都没有字节官方的确认。Seed 的检验节点写得很清楚:年底之前,Coding 能力要产生类似智谱 GLM-5.2 和 Kimi-K3 的行业冲击力。
参考链接
- ,2026-08-30
- ,2026-08-30
- ,2026-08-19