AREX Feed Article
The Information 独家:Google DeepMind 负责人称 Gemini 4 进入早期后训练,预计远早于年底发布
北京时间 9 月 24 日上午, 发布独家报道称,Google 接近发布其旗舰模型 Gemini 4。这篇由 Laura Bratton 署名的报道援引 Google DeepMind 负责人、高级副总裁(SVP)Koray Kavukcuoglu 周三(9 月 23 日)的说法:模型目前处于早期后训练(post-training)阶段,发布时间预计比年底「早得多」。
同一场合的一手记录更为直接。The Information 创始人 Jessica Lessin 在中写道,Gemini 4 「即将到来」,肢体语言暗示「肯定在年底之前」。Kavukcuoglu 随后,间接印证访谈属实,不过 Google 未发布官方确认。
The Information 该篇报道页面的头图:Kavukcuoglu 在该媒体的 AI Agenda Live 活动现场。
从现场笔记到独家报道,间隔不到一小时
这场对话发生在 The Information 的 AI Summit 上。北京时间 9 月 24 日 9 时 17 分,Lessin 发帖列出访谈中记下的速记,称这是 Kavukcuoglu 「接管整个 DeepMind 以来」的首次专访;58 分钟后的 10 时 15 分,署名 Laura Bratton 的报道上线,标题为「Google Nears Release of Flagship Gemini 4 AI Model」;再过约 80 分钟,11 时 34 分,Kavukcuoglu 写道:「感谢邀请,和你聊得很开心。」这条帖子没有回应笔记中的任何具体说法。
12 时 59 分,现场听众 Susan O'Brien 在 Lessin 的帖子下补充:她听到的说法是 Gemini 4 会比年底「早得多(希望如此)」,而距年底「只剩三个月」。她在 X 个人简介中自述在 Cisco 负责 AI 方面的传播工作。
「早期后训练」:离发布还剩哪几步
The Information 报道给出的新信息,是模型所处的阶段。据该报道,Kavukcuoglu 表示 Gemini 4 处于早期后训练阶段。后训练指大规模预训练完成之后的调优工序,包括对齐、安全与能力打磨等,通常是一代旗舰模型对外发布前的收尾步骤;「早期」意味着这轮收尾刚刚开始。
把两条信息放在一起:从现在到年底约三个月,一个还在后训练前段的模型,按他的说法会在这段时间内发布。不过,这些表述全部来自当事人访谈与单一媒体报道,报道正文置于付费墙之后。
现场速记:不放慢、安全同步建,AGI「不是正确的对话」
Lessin 的速记记录了 Kavukcuoglu 对 Google 位置的判断。他称 Google 「无疑处于前沿」,并表示没必要放慢,因为安全「始终要与能力同步构建」;Lessin 追问,特别是在提到 looped transformers 这类新技术时,他较深入地谈了思维链(chain of thought)方面的工作。
在目标定义上,他不同意以 AGI(通用人工智能)为框架,称那「不是正确的对话」,最好的框架是「持续改进的智能」。速记还提到:他谈了智能体在编程中的角色、过去六个月的变化以及他对递归自我改进(recursive self-improvement,RSI)的看法;谈到模型蒸馏时他不以为意,乐于指出蒸馏是 Google 发明的,Lessin 特意标注这是他自己的说法。
Lessin 在笔记末尾补了一条她本人的观察:Google、Meta 与 Microsoft 发出的是一种语气,Anthropic 和 OpenAI 则是完全不同的另一种;而在多个例子上,Kavukcuoglu 拒绝了外部流行的叙事,给出另一种说法。
谈 TPU:优势在硬件,「给竞争对手用不是问题」
关于芯片,Lessin 记下他非常看好 Google 在 TPU(Tensor Processing Unit,Google 自研的 AI 芯片)上的持续硬件优势,并谈到新一代 TPU 如何与他的团队协同设计。至于把 TPU 交给 Anthropic 这样的竞争对手使用,他的回应是「不是问题」,理由是这有助于规模化与持续改进。
谁在说这句话:8 月接棒 DeepMind 的高管
Kavukcuoglu 的头衔可以由公开资料交叉印证。Google 官方博客的介绍他为「SVP, Google DeepMind and Chief AI Architect, Google」,此前他任 Google DeepMind 研究副总裁,创办了深度学习团队,该团队做出过 DQN(深度 Q 网络)、WaveNet 等成果;据 8 月 12 日的报道,他此前还担任过 DeepMind 的 CTO。
8 月,DeepMind 换帅。据 CNBC 报道,Kavukcuoglu 升任 SVP,接替联合创始人兼 CEO Demis Hassabis(转任该机构主席),直接向 Google CEO Sundar Pichai 汇报,分管 Gemini 模型研发、前沿 AI 研究以及 Gemini 应用与开发者团队。他本人 8 月 5 日向 Pichai 致谢,称「荣幸带领 GDM(Google DeepMind)进入下一章」,并向转任 Alphabet 首席科学家兼 Google DeepMind 主席的 Hassabis 表示祝贺。
他给出这份时间表的时机,是 Google 在前沿竞赛中追赶的当口。据 CNBC 报道,Google 在 2025 年 11 月发布 Gemini 3、今年 2 月发布 Gemini 3.1 Pro 之后,今年的发布未能继续挑战前沿位置,而 Anthropic 的 Mythos 被 CNBC 描述为开辟了新局面,OpenAI 的 GPT-5.6 也获得类似赞誉;7 月,Alphabet 股价下跌,此前 Bloomberg 报道称 Google 推迟了 Gemini 3.5 Pro 的发布,以改进编程等方面的表现。CCS Insight 首席分析师 Ben Wood 当时对 CNBC 表示,新老板的目标「无疑是在某些领域缩小与 Anthropic 和 OpenAI 的差距」。
Kavukcuoglu 自己的账号则显示 Flash 系列在快速迭代:8 月 13 日发布 ,他称「仅用三个月从 3.5 走到 3.7」;9 月 2 日推出 ;9 月 15 日推出。
Kavukcuoglu 在 Google 官方博客作者页上的资料照片。
还没答案的:日期、规格与算力
到目前为止,可以确认的是这些判断都出自他本人的口头表述;还不能确认的,是产品本身。发布窗口没有落到具体日期,模型参数与基准成绩没有随报道公布。算力这道题也没有答案:Lessin 写道,她「没能弄清」算力会不会构成挑战;她提出的个人猜测,Gmail 里的 Gemini 表现不够好是因为需要更多数据中心,被他当场否定。
下一个可以直接核验的节点,是 Lessin 预告的访谈视频。