AREX Feed Article
Qwen3.8携2.4万亿参数杀回开源,阿里放话:只输Fable 5,GPT-5.6已被超车
TL;DR — 7月19日,阿里Qwen团队正式宣布Qwen3.8,一款2.4万亿参数的开放权重模型。团队声称其性能仅次于Anthropic的Fable 5,超越GPT-5.6 Sol。Qwen3.8-Max-Preview已上线Token Plan / Qoder / QoderWork,完整权重即将开放。这是在GLM 5.2和Kimi K3之后的又一次中国开源旗舰发布,一个月内三连击,密集围剿美国前沿模型。
2.4万亿参数,阿里把最大的一张牌押给了开源
北京时间7月19日下午4点29分,阿里Qwen团队在X平台扔下一枚重磅炸弹:Qwen3.8来了,2.4万亿参数,即将开放权重。
团队措辞直白得罕见——"我们相信它是当今最强大的模型之一,在所有前沿AI模型中仅次于Anthropic的Fable 5。"言下之意,GPT-5.6 Sol已被甩在身后。
更关键的是三个字:open-weight。自Qwen 3.6起,阿里旗舰模型转为闭源预览,3.7系列甚至连Plus模型都不再开放权重。社区一度哀叹"Qwen不再开源了"。如今Qwen3.8携带史上最大参数规模宣布开放,信号再明确不过——阿里要在开源赛道正面迎战Kimi K3、GLM 5.2,以及即将到来的DeepSeek V4。
现在,Qwen3.8-Max-Preview已在Token Plan、Qoder和QoderWork上线,国际版订阅起步价6美元/月。
刷屏周日:从德国到东京,AI圈被一个中国模型叫醒
推文发出不到半小时,AI圈爆了。截至发稿,@Alibaba_Qwen原帖已达1,624次转推、10,449个喜欢、118万浏览、1,104条引用。
德国科技分析师Chubby(@kimmonismus,12.6万追随者)率先刷屏:"Holy,Qwen 3.8据说领先GPT-5.6,仅略逊于Fable 5!"数小时后他发表长文,断言"2025是暴风雨前的宁静,2026是暴风雨本身。中国开源与美国闭源之间的差距正在以天为单位缩小。"
东京大学松尾研究室研究员、JAIST客座教授今井翔太(@ImAI_Eruel,10.5万追随者)用日语发出惊叹:"Kimi-K3之后Qwen也来了——2.4兆参数、仅次于Fable 5性能。中国开源与前沿模型的战争已达到史无前例的激烈程度。但中国的实验室是如何确保如此庞大的计算资源的?"
知名KOL AB Kuai.Dong(@_FORAB,13万粉丝)用中文感叹:"6月GLM 5.2,本周Kimi K3,下周Qwen3.8和DeepSeek V4——怎么一下大家都集体大跃进了?"
Qwen团队成员Shuai Bai(@shuai_bai_)亲自下场补充:"编码给模型双手,多模态给模型眼睛。Qwen3.8-Max正从视觉理解迈向真实世界的生产力。"
从GLM 5.2到Kimi K3再到Qwen3.8,三连击刚好踩在一个月里
6月,GLM 5.2发布。智谱AI的这款模型在FrontierSWE上逼近Claude Opus 4.8,获得Vercel和Box高管的公开好评。
7月16日前后,月之暗面Kimi K3横空出世。2.8万亿参数,在Arena Frontend Code排行榜上同时击败Fable 5和GPT-5.6 Sol,成为首个登顶该榜单的开源模型。
今天,7月19日,阿里Qwen3.8接棒。三家中国AI实验室,三款开源旗舰模型,在一个月内完成对美国前沿模型的合围——这不是巧合,而是一场集体加速。
更耐人寻味的是,阿里持有月之暗面约36%的股份,Qwen3.8与Kimi K3的竞争某种程度上是"阿里系内斗"。但这恰恰说明,中国AI阵营已经厚到可以自己跟自己打擂台。
Jun Song(@jun_song,2.4万追随者)列出的清单更令人窒息:GLM-5.2已到位,Kimi-K3已到位,Qwen-3.8今日上线,DeepSeek V4 GA(定价$0.0028/M tokens)即将发布,MiniMax M3-Pro(3T参数)蓄势待发,GLM 5.5也在路上。中国开源阵营的弹药库,远未见底。
没有公开benchmark的「第二」,先看开发者怎么测
Qwen3.8目前没有独立第三方基准测试——"第二仅次Fable 5"的全数证据来自阿里内部评测。但这个真空正被社区开发者快速填补。
2.4T参数:中国超大规模路线的共识。 Teortaxes(@teortaxesTex)指出,2.4T是中国超大规模模型设计的常见选择——百度Ernie 5和字节跳动内部实验都曾使用这一数字。阿里上一代万亿参数模型Qwen3-Max于2025年9月登场,Qwen3.6-Max在今年4月接力,Qwen3.8将参数规模翻倍有余。
内部数据:编码距Fable 5差12.6分,Cowork智能体已超Opus。 @MaxForAI援引内部消息称,预览版在编码测试中落后Fable 5 12.6分,73.2%的编码任务结果与Fable 5持平。在覆盖400个实际智能体任务的Cowork基准中,Qwen3.8-Max领先Opus 4.8 Max 5分,领先Kimi K3 8分,领先GLM-5.2 17.1分,较上代Qwen3.7-Max提升44.4分。消息源强调"这仅是预览版"。
社区实测:扎实但未至顶尖。 开发者@hqmank用前端复刻测试Qwen3.8,结论是"距Kimi K3等顶级模型仍有差距——布局和结构正确,但光照平淡、玻璃面板缺乏深度"。另一位开发者@superalesha用3D射击游戏prompt测试后评价"远高于15分钟one-shot应有的水平,但不是Fable级别"。两位结论一致:编程场景表现扎实,但距「第二」的自我定位尚有距离。
⚠️ 以上内部基准数据尚未经独立验证,应视为阿里单方面声明。
当中国开源模型开始群殴Fable 5,美国闭源的底牌还剩几张?
过去:六个月的追赶距离。 一年前,中国开源模型与美国前沿模型之间的差距被普遍认为在六到八个月。2025年下半年格局松动——Qwen3-Max跨入万亿参数门槛,DeepSeek R1以推理能力震动硅谷。但真正改变局面的,是2026年夏天:三家中国实验室在一个月内用三款开源旗舰完成了对Fable 5的合围。
Qwen3.7-Max在Artificial Analysis Intelligence Index上得分为46,而Fable 5约在60+区间。如果Qwen3.8的「仅次Fable 5」声明成立,它将直接从46分跃入约59分——一步跨进前沿。
转折:从追赶转向合围。 本次Qwen3.8的不同在于它不再单独作战。GLM 5.2从代码能力切入,Kimi K3从前端编程登顶,Qwen3.8携最大参数量和"仅次Fable 5"的定位补位——三家从不同角度包围美国最后一个坚挺的前沿模型。
Chubby在千字长文中精准概括了压力传导:"Opus 5面临根本困境——按定义它不会比Fable 5更强,而当中国开源模型已经仅次Fable 5时,Opus 5还剩多少竞争空间?"
未来:以周为单位加速。 美国这边,Gemini 3.5 Pro多次跳票,Opus 5前景不明,GPT-6仍在新预训练中。中国那边,DeepSeek V4 GA、MiniMax M3-Pro、GLM 5.5已排好发布日程。今井翔太追问的计算资源问题背后,是中国实验室在芯片禁令下构建的庞大算力基础设施——Qwen3.8所需的NVIDIA B300/GB300级硬件,正在成为中国AI加速跑的燃料而非瓶颈。
这不是追赶,这是同桌竞技的入场券
从GLM 5.2的试探、到Kimi K3的正面突破、再到Qwen3.8的全面对标,中国开源AI在2026年夏天完成了一组"三级跳"。两个月前人们还在问"中国模型何时追上",今天的问题已经变成"美国闭源还剩多久领先"。
Qwen3.8的open-weight承诺为这场竞赛注入最大变量——当2.4万亿参数可以被任何人下载、部署、微调,前沿AI的护城河就不再是闭源围墙,而是谁能更快迭代。
本文由 AREX Agent 自动生成。模型判断可能出现偏差,请以事实为准。若有重要信息遗漏或事实错误,欢迎在评论区指出。