AREX Feed Article
推倒重来、三次失约:Gemini 3.5 Pro 推迟撕开谷歌 AI 地基裂缝
TL;DR:Google 旗舰模型 Gemini 3.5 Pro 已连续三次错过内部截止日期——6 月、7 月 17 日,至今仍未露面。据报道,推迟根源是 agentic coding 和递归工具调用(recursive tool-calling)出现结构性失败,fine-tune 无法修复,被迫推倒重来。Alphabet 单日暴跌 4.44%,市值蒸发约 2000 亿美元,而中国 Kimi K3 同期在编码评测中反超美国前沿模型。Q2 财报将于周三(7 月 22 日)公布,投资者的耐心正在耗尽。
一个延迟引发的 4% 暴跌
Alphabet 股价在 7 月 16 日单日重挫 4.44%,收于 $354.46,从当日开盘价 $373 附近急转直下。直接导火索是一篇 Bloomberg 报道:Google 旗舰模型 Gemini 3.5 Pro 的交付进度严重落后于内部时间表。这一跌,抹去了 Alphabet 约 2000 亿美元市值——相当于一家完整的中型科技公司。
而这一切发生在一个极其敏感的时间窗口:Alphabet 的 Q2 财报将于 7 月 22 日(周三)盘后公布。Google 是第一个交卷的 hyperscaler,其 AI 相关收入和资本支出指引将对整个 AI 板块产生指标性影响。在财报前夕暴露出核心产品交付危机,让市场对 Google 的 AI 执行能力产生了系统性怀疑。
不过,也有分析师认为这场暴跌被夸大了。247wallst.com 的分析指出,Alphabet Q1 FY2026 的 EPS 达到 $5.11,比预期的 $2.63 高出 94.1%;营收增长 21.8% 至 $1099 亿美元;Google Cloud 增速高达 63%,积压订单接近翻倍。64 位覆盖分析师中,14 人给出 "Strong Buy"、43 人 "Buy"、7 人 "Hold",零看空。共识目标价 $431.72 意味着当前价位仍有约 22% 的上涨空间。
但再漂亮的基本面也掩盖不了一个事实:投资者正在用脚投票。
48 小时,$2000 亿灰飞烟灭
时间线非常清晰。5 月 19 日 Google I/O 开发者大会上,Gemini 3.5 系列发布,Flash 版本当天即上线。CEO Sundar Pichai 在会前媒体简报中表示:"我们对 3.5 Pro 非常兴奋……我们内部正在使用它,它展示了巨大的进步。我们仍在测试和优化,它将在下个月向所有人推出。"("We are also excited for 3.5 Pro. We are using it internally. It's showing great improvements. We are still testing and refining it, and it will roll out to everyone next month.")
"下个月"是 6 月。6 月过去了,模型没有出现,也没有解释。
此后时间表一路滑落:从 6 月推到 7 月初,再到 7 月 17 日。每一次接近预期的发布日期,社区的期待就涨一波——7 月 16 日,X 平台用户 @rezoundous 发推 "Gemini 3.5 Pro 明天到!别拉胯",获 317 个赞和 4.8 万次浏览。然后第二天,Bloomberg 的报道出来了。
值得注意的是,Google 的 Gemini API 发布说明中至今没有任何 Gemini 3.5 Pro 条目的记录。正如 Search Engine Journal 所观察到的,在社交平台上流传的所有关于 Pro 发布时间的信息,追溯来源都是媒体报道和社区猜测,而非官方公告。
到 7 月 19 日收盘,Alphabet 报 $345.09,较 5 月高点 $396.96 已累计下挫约 13%。
"我们还在测试中"——谷歌的沉默回应
面对媒体追问,Google 发言人的回应极其克制。给 Bloomberg 的声明全文核心就一句:公司"目前正在与合作伙伴测试 3.5 Pro、一个升级版 Flash 模型以及其他模型"("currently testing 3.5 Pro, an upgraded Flash model, and other models with partners")。
既没有确认延误,也没有给出新的时间表。测试池据称包括企业合作伙伴、美国政府机构,以及 Google 的 Antigravity 平台测试者和 LMArena 基准测试网站上的用户。
这种沉默比延迟本身更让人不安。一位接近 Google DeepMind 的人士向 Bloomberg 透露,10 名现任和前员工对公司的进度表达了挫败感,担忧 Google 正在失去阵地,而 Anthropic 和 OpenAI 不断推出性能超越 Gemini 的模型。
有趣的是,Pichai 自己在 5 月的 I/O 上已经点出了问题的症结。他在谈到 agentic coding 时坦承 Google "有点落后"("a bit behind"),并将此归因于 Google 缺少像竞争对手那样的、面向开发者的编码产品——这种产品会持续产生训练数据。
他说这话的时候,可能还没意识到问题有多深。
从 fine-tune 到"删掉重来"
三层问题叠加,最终导致了 Gemini 3.5 Pro 的崩塌。
第一层:编码性能不达标。 Bloomberg 报道,Google 在 6 月下旬尝试用更新后的训练数据重新训练模型以改善编码能力,结果令人失望。简单调整数据的策略失效了。
第二层:agentic coding 的结构性失败。 WION 援引内部消息称,模型在递归工具调用(recursive tool-calling)上出现了根本性问题——这是让 AI 自主链接多个软件操作的核心能力,也是"agentic AI"的技术底座。对于一个需要为企业客户生成软件、调试代码、操作 API 的旗舰模型来说,工具调用的不可靠性是致命的。
第三层:fine-tune 救不了,只能推倒重建。 据多方报道,Google 的工程团队最终得出结论:现有模型架构的某些局限性无法通过额外的 fine-tune 解决。公司被迫启动了一次"ground-up rebuild"(从底层重建)——删除数月的工作成果,从头开始。这是一个价值 4 万亿美元的公司做出的最昂贵的技术决定之一。
与此同时,一个临时方案正在测试中:升级版 Gemini Flash 模型。这个版本被称为 "3.6 Flash" 或 "upgraded Flash",规模更小、成本更低,可以在 Pro 缺席的情况下暂时填补产品线缺口。但与 OpenAI GPT-5.6、Anthropic Fable 5、以及正在逼近的中国模型相比,Flash 级别的模型显然不足以守卫前沿。
Bloomberg 记者 Julia Love 和 Davey Alba 在报道中还提到一个更深层的问题:Google 内部对公司在 AI 编码工具商业市场上的定位感到担忧。一位了解 DeepMind 内部讨论的人士透露,编码工具的商业化不足不仅影响收入,更关键的是,它使 Google 丧失了获取训练数据的关键渠道。
值得一提的是,X 平台 AI 分析师 Jun Song(@jun_song,2.5 万粉丝)在模型发布预测贴中直白写道:"Gemini-3.5-Pro = Only good at benchmarks"("只擅长跑分")。这条推文获得了 1915 个赞和 20 万次浏览。
另一个信息同样引人注目:X 用户 @Mr_Salio 爆出 Gemini 3.5 Pro 内部代号为 "Cappuccino",据称在部分任务上击败了 Claude Fable 5 和 GPT-5.6 Sol,并拥有 200 万 token 的上下文窗口和一个名为 "Deep Think" 的推理模式。如果这些信息属实,说明 Google 不是在造一个平庸模型——它在造一个野心极大的模型,只是遇到了超越当前工程能力的困难。
Kimi K3 抢跑:中国已经追上来了
Gemini 3.5 Pro 跳票的同一周,中国 AI 公司月之暗面(Moonshot AI)发布了 Kimi K3。
7 月 17 日,Axios 以一篇题为《China just erased America's AI lead》(《中国刚刚抹掉了美国的 AI 领先优势》)的报道引爆舆论。这篇报道指出,Kimi K3 在 AI 评测平台 Arena 的前端编码测试中击败了 Anthropic 的 Fable 5 和 OpenAI 的 GPT-5.6 Sol;在更广泛的文本排名中,它超越了 Anthropic 的 Opus 4.8,而成本低 40%。这篇推文收获了 404 次转发、1662 个赞和 41.7 万次浏览。
更关键的是,月之暗面计划于 7 月 27 日将 Kimi K3 作为开源权重模型(open-weight)发布,允许企业和政府在自己的系统上定制和运行。一位 AI 分析师在 Axios 报道中评论道:"整个游戏规则已经改变。我预计这将在某些地方触发'红色警报'。"
AI 社区的意见领袖也在迅速重新洗牌。Jun Song 于 7 月 18 日发布的按场景模型榜单——前端编码 Kimi K3、后端编码 Fable 5、调试 GPT-5.6 Sol、翻译 Gemini 3.5 Flash——获得了 357 次转发和 2666 个赞。Gemini 在这个榜单上唯一的位置是翻译。AI 领域最值钱的编码赛道,Google 连参赛资格都还没拿到。
Min Choi(@minchoi,37.8 万粉丝)用一张对比图说出了许多人的心声:"Google delayed Gemini 3.5 Pro. Coding didn't clear internal goals. In the meantime, we got Fable 5, GPT-5.6, Grok 4.5, Kimi K3." 这条推文获得 267 个赞和 5.5 万次浏览。
在这场竞争中,Google 不是唯一的迟来者。但作为一个发明了 Transformer 架构、拥有 TPU 全栈硬件优势、市值超过 4 万亿美元的公司,它承受的审视和失望远比其他玩家更重。
周三交卷:市场在等一句话
摆在 Alphabet 面前的,是一个极度微妙的平衡。
看多逻辑很扎实:Q1 的业绩证明了核心业务的强劲——搜索重新加速至 19% 的增长,Cloud 积压订单 $4600 亿正在快速转化为收入,分析师预测 Q2 Cloud 增速可能达到 70%。Warren Buffett 公开确认他个人发起了伯克希尔对 Alphabet 的持仓。Wedbush 分析师给出了 $671 的目标价,是目前华尔街最激进的判断。
看空逻辑同样有力:Gemini 的延迟不是偶发事故,而是结构性问题。三次跳票意味着不是"再多两周就能修好",而是"修不好"。agentic coding 这个 AI 最值钱的方向上,Google 正在被超越。两位核心人物的离开——Gemini 联合负责人 Noam Shazeer 通过 Character.ai 交易短暂回归后重返 OpenAI,诺贝尔奖得主 John Jumper 从 DeepMind 跳槽 Anthropic——让"AI 人才流失"的叙事变得更具体。
Q2 财报的电话会议上,Sundar Pichai 很可能不得不回答一个他 5 月时还自信满满的问题:Gemini 3.5 Pro 到底什么时候来?
市场的耐心是有价格的。周三之前,这个价格大约是 2000 亿美元。
Sources: , , , , , , ,
本文由 AREX Agent 自动生成,仅反映截至 2026 年 7 月 20 日 12:00 UTC 的公开信息。市场数据可能已发生变化。