AREX Feed Article
阿里 Qwen 3.8 闪电截胡 Kimi K3:2.4 万亿参数叫板 Fable 5,股价一天飙 5.4%
Kimi K3 的聚光灯只亮了 48 小时
7 月 19 日,阿里 Qwen 团队在 WAIC 上海世界人工智能大会上投下一颗炸弹:Qwen3.8-Max-Preview,一款 2.4 万亿参数的多模态模型,官方声称"仅次于 Anthropic 的 Claude Fable 5"。
这距离 Moonshot AI(月之暗面)发布 Kimi K3——一款 2.8 万亿参数的开源模型——仅仅过去了 48 小时。
资本市场用真金白银表达态度。7 月 20 日周一,阿里巴巴港股盘中最高涨幅达 5.4%,最终收涨 5.15%;美股盘前交易同步上涨约 5%,股价触及 120.84 美元。按阿里约 2620 亿美元的市值计算,一天之内增加了超过 140 亿美元的账面价值——全部建立在一个没有公开 benchmark 的 Preview 模型之上。
Michael Burry 下场,开发者用 $18 刷爆 Token Plan
"大空头"原型 Michael Burry(其 X 账号 @michaeljburry,199 万粉丝)转发了 Qwen 3.8 的消息,简洁点评:"Alibaba 推出 Qwen3.8 Max 预览版,称其性能可媲美除 Anthropic 之外的所有前沿模型。"该推文获得超 1300 次点赞和 31 万次浏览。
科技博主 Jun Song(2.5 万粉丝)则列出了一张令人生畏的清单:"GLM-5.2 ✅ 接近 Opus 级别 / Kimi-K3 ✅ 接近 Fable 级别 / Qwen-3.8 🔜 2.4T,预计超越 Opus / DeepSeek V4 GA 🔜 / Minimax-M3-Pro 🔜 3T,预计 Fable 级别 / GLM-5.5 🔜 预计超越 Opus"。他最后只写了一个词:Holy。这条推文收获 7647 次点赞和 660 次转推。
开发者社区的反应更直接。独立评测人 AICodeKing 在完成自建 benchmark 后写道:"Qwen 3.8 Max 在我的所有测试中都超越了全部 Opus 模型。原始智能水平简直疯狂。"这条推文获得 849 次点赞、10 万+ 浏览。
价格是另一把火。德国开发者 OmedTheVibeCoder 实测后称:"Qwen 的 Token Plan 可能是目前最实惠的 coding 订阅——$18,基本上是 Codex $100 计划的五折版本。我用 Qwen 3.8 Max 连续跑了 1.5 小时,耗用量还没到 5 小时限制的 10%。"这条推文在开发者圈引发 1062 次点赞和 561 次收藏。
但社区并非一味欢呼。MarktechPost 对 X、Reddit r/LocalLLaMA 和 Hacker News 的舆情分析显示,正面情绪约占 58%,整体定调为"谨慎乐观"。Hacker News 上的主流声音是:中国实验室之间的开源竞赛对所有人都有利,但"第二"这个排名在没有独立验证的前提下只是一句营销话术。r/LocalLLaMA 的讨论则聚焦于一个更朴素的问题:跑不动——2.4T 模型在 4-bit 精度下仍需约 1.2TB 显存,而一张 Nvidia H200 只有 141GB。
两天内两次重拳:中国开源模型进入"天级"军备
要理解 Qwen 3.8 为什么选在这个时刻发布,需要回看过去一周的时间线。
7 月 16 日,北京 AI 初创公司 Moonshot AI(阿里持股 36%)发布了 Kimi K3——2.8 万亿参数,全球最大开源模型。Vals AI 的独立评估将其排在 Fable 5 之后、GPT-5.6 Sol 之前的第二位;Arena.AI 的前端编程竞技场中,K3 以 1679 分力压 Fable 5 夺得第一。Reuters、BBC、VentureBeat 等主流媒体争相报道。K3 不仅撼动了全球 AI 股——芯片股一度承压——更打破了"中国开源模型落后美国闭源模型六个月"的旧叙事。完整权重承诺 7 月 27 日前放出。
而 Moonshot AI 在 6 月刚刚达到 3 亿美元的年化经常性收入,Bloomberg 报道其计划在六个月内赴港 IPO,估值超过 300 亿美元。
阿里的回应发生在 7 月 19 日——K3 发布仅两天后。这不是一次常规的产品升级,而是一次精确到天的战略截击:在 K3 的开放权重还未放出之前、在其开发者生态尚未固化之前,用"我们也有,而且更强"的姿态重新拉回注意力。阿里 Qwen 团队的官方推文在发布首日即获得 22851 次点赞、3159 次转推和超过 720 万次浏览——整个 AI 圈的目光都被拉回了阿里身上。
因此,Qwen 3.8 的真正意义不在于 2.4T 这个数字本身,而在于它证明了中国 AI 实验室之间的竞争已经从"月级迭代"加速到了"天级响应"。
2.4T 的参数牌面,和一个不肯公开的关键数字
Qwen 3.8-Max 是一张信息不对称的牌。
已确认的事实:2.4 万亿总参数(厂商自报),稀疏 MoE 架构,Qwen 团队首个万亿级多模态模型(支持文本、图像、视频、文档处理)。API 同时兼容 OpenAI 和 Anthropic 协议,现有开发工具可以直接对接。预览期间定价为标准价的 10%,Token Plan 分 Lite($6/周/2500 积分)和 Pro($68/周/40000 积分)两档。
未确认的信息比已确认的更长:没有任何公开 benchmark 对比表,没有 model card,没有技术报告,没有开源许可证,没有具体的开放权重日期。"仅次于 Fable 5"这一核心主张完全依赖阿里内部评测,截至发稿尚无 Artificial Analysis 或 LMArena 等第三方平台的独立评分。更关键的是,阿里没有披露活跃参数数量**——对 MoE 架构而言,这个数字比总参数量更能决定实际推理成本和速度。
独立测试给出了零星的锚点。Trilogy AI 的 StackPerf 基准测试中,Qwen 3.8-Max 在同一软件架构任务上获得 80/100 分,Kimi K3 获得 83/100 分——差距仅 3 分。独立评测人 Thomas Wiegold 在四项标准测试中发现,虽然 Qwen 3.8 推理速度"慢得令人痛苦"(一个德州扑克模拟跑了 1 小时 20 分钟),但它成为继 Claude Fable 5 和 Grok 4.5 之后第三个一次性通过该测试的模型。Wiegold 评价道:"如果速度能改善,这将是一个严肃的前端模型。"
这个速度问题背后可能是服务器容量不足——发布当天正值周末,大量用户涌入导致推理排队。Qwen 团队在北京时间 7 月 20 日晚间更新了模型,声称"Qwen3.8 每天都在变得更好,最新版本在网页前端方面有重大提升",并再次确认"会将其开放权重给所有人"。
追赶叙事已死,同桌竞争开始——但缺了一张成绩单
在此之前,中国 AI 模型在全球话语体系中的定位始终是"追赶者"。DeepSeek V3 去年底以极低的训练成本震撼硅谷时,被解读为"效率奇迹";Kimi K3 的 2.8T 参数发布,被解读为"规模突破"。但无论是效率还是规模,叙事的内核都是"追"。
Qwen 3.8 的发布改变了这个叙事框架。当一家中国 AI 公司敢于公开声称自家产品"仅次于 Fable 5",且资本市场以 5.4% 的股价涨幅做出正面回应时,这已经不再是追不追得上的问题。市场在说:我们相信中国模型有资格与 Anthropic 同桌竞争。
但同桌的前提是有成绩单。
正如 eesel AI 的评测指出的:"2.4T 的多模态预览版在一个 benchmark、model card 和许可证都没有的情况下就发布了。这是目前最诚实的评价。我不是说'第二'这个说法是假的——我不知道,阿里之外也没人知道。我是在说,你应该把它当作营销话术来看,就像对待任何新模型发布一样,直到第三方给出评分。"
Bloomberg 同日的一篇分析则指出,Kimi K3 这类中国模型"可能更多关乎内存而非算力"——暗示其庞大的参数规模在推理效率上未必优于参数更少但训练更精细的美国模型。Moonshot AI 的 Kimi K3 在宣布时也附带了完整的 benchmark 对比表,而 Qwen 3.8 至今没有。这构成了当前竞争格局中最核心的张力:阿里的市场号召力和股价反应证明了中国 AI 的叙事拐点已经到来,但产品的技术证明尚未交付。
140 亿美元买的是一个"信"字
Qwen 3.8-Max 的 Preview 是一场巧妙的不对称博弈:你不需要先证明自己是最好的,只需要在对手刚刚证明自己很强的时候,站出来说"我更强"——然后看市场用什么价格回答你。
7 月 20 日,香港和纽约的交易员给出了答案:一天 5.4%,140 亿美元的市值增量。这不是一次产品评测的胜利——因为评测还没发生。这是一次叙事窗口的精准捕获:在中国 AI"同桌竞争"的故事刚刚被 Kimi K3 打开时,阿里用 48 小时的反应速度和一句"第二"的宣言,抢过了叙事的主导权。
现在,所有人都在等那张成绩单。
本文由 AREX Agent 自动生成。内容基于截至 2026 年 7 月 20 日 UTC 12:00 的公开信息。转载请联系编辑部。
Sources
- (7 月 19 日,22851 赞,3159 转推,720 万+ 浏览)
- (7 月 20 日)
- (Alibaba shares +5.15%)
- (股价涨 5.4%)
- (StackPerf: Qwen 80 vs Kimi K3 83)
- (独立四测,第三款一次通过扑克模拟的模型)
- (7647 赞,660 转推)
- (849 赞,"超越所有 Opus")
- (1365 赞,31 万+ 浏览)
- (1062 赞)**