AREX Feed Article
阿里 Qwen 兑现承诺:Qwen3.8-27B 开放权重上线,Apache 2.0 可商用
北京时间 8 月 14 日 23:02,阿里 Qwen 官方账号 发文宣布 Qwen3.8-27B 开放权重正式上线,Hugging Face 与 ModelScope 均可下载。推文开头写道:"We promised open weights for Qwen3.8. Now, time to meet them!"(我们承诺过 Qwen3.8 的开放权重,现在来见见它们。)
推文给出三组关键规格:27B 参数的原生多模态稠密模型,官方称整体表现超越 Qwen3.7-Plus,主打真实编码与办公工作流;262K 原生上下文,可通过 YaRN 扩展至 1M token;Apache 2.0 许可。同一条推文还确认,Max 级 Qwen3.8-2.4T-A95B 的开放权重也已于近期发布("have also been released recently")。
27B 稠密多模态:编码与办公全面压过 Qwen3.7-Plus
把"整体超越 Qwen3.7-Plus"落成了基准表。编码侧:Terminal Bench 2.1 得 73.0(Qwen3.7-Plus 为 64.0),SWE-bench Pro 61.7 对 57.6,DeepSWE 1.1 42.2 对 14.2,Qwen 自建 QwenSWEBench 79.0 对 59.2。
办公侧:CoWorkBench 70.7 对 65.1,JobBench 33.4 对 27.6。多模态侧 OSWorld-Verified 84.3 对 73.3。
表里也有两行落后:GPQA Diamond 89.2 对 90.3,HLE 30.8 对 34.7。"整体超越"是官方口径,不是每一行都赢。
模型是 27B 参数的因果语言模型加视觉编码器,原生理解图像与视频,覆盖 STEM 图表、文档与小时级视频。
架构沿用 Qwen3.5 底座:64 层、隐藏维度 5120,Gated DeltaNet 与 Gated Attention 混合堆叠(每 3 层线性注意力接 1 层门控注意力,共 16 组),并以多步预测 MTP 训练。
上下文窗口写为 262,144 原生、可扩展至 1,000,000;官方推文点明扩展方式为 YaRN。思考模式默认开启、可按请求关闭,reasoning_effort 提供 xhigh、medium、low 三档调节推理深度。
许可方面,推文写 Apache 2.0,元数据的 License 字段同为 apache-2.0。
8 月 3 日承诺,权重在发推前两分钟更新完
Qwen3.8-Max 于 8 月 3 日发布(据智东西),预告权重将于下周在 Hugging Face 与 ModelScope 开源。,Qwen3.8-2.4T-A95B 权重"刚刚"开源,并称"根据魔搭社区的官方预告,更小杯 Qwen3.8-27B 已在路上"。
27B 这一步的落地时间,魔搭元数据精确到了秒:显示该仓库创建于 8 月 12 日 09:25 UTC,最近一次更新是 8 月 14 日 15:00:10 UTC。官方推文发布于 15:02:48 UTC,权重在官宣前约两分半钟更新完毕。
作为对照,显示该仓库最近更新于 8 月 12 日 22:26 UTC(北京 8 月 13 日 06:26),比智东西的"刚刚开源"报道早一个多小时。
截至发稿,魔搭 Qwen3.8-27B 页显示下载 1,376 次。
发推两个多小时后,Mac 已经跑起来了
推文发出约 2 小时 30 分后,X 用户 宣布把 Qwen3.8-27B 列为 mlx(.)fast 的下一场 Apple Silicon 挑战机型,正在量化 4-bit MLX 版本。几分钟后,工程师 (AICTechPro 创始人)放出转好的 MLX 纯文本版(去掉视觉与 MTP):4-bit 15GB,在 M5 Max 上跑出 33 token/s。
17:44 UTC, 贴出完整部署记录:Mac Studio(M4 Max,64GB)运行 incept5/Qwen3.8-27B-MLX-4bit,开 256K 上下文,输出约 28 token/s,称图片识别"很精准"。
下载环节也有人感受到拥堵:UpCloud 首席营销官 发推写道:"Trying to download right now at 3.2kbps…Is the whole world trying to get it at the same time?!"(正以 3.2kbps 的速度下载,难道全世界都在同时下它?!)
官方推文截至发稿约 1,015 次转推、6,624 个赞、53.9 万次查看。
1M 默认上下文和内置工具,只在还没上线的托管版
模型卡同时写明:Qwen3.8-27B 还将提供托管版本,带默认 1M 上下文、官方内置工具等生产特性,状态是 coming soon。今天能下载的权重是 262K 原生、经 YaRN 扩到 1M;默认就开 1M 属于还没上线的云端服务。
称,这是 Qwen 首次把 Max 级模型开放发布;但开放权重版是纯文本、思考模式不可关闭,视觉输入、关闭思考、默认 1M 上下文都属于基于它的 Qwen3.8-Max API。
魔搭元数据里,2.4T-A95B 的 License 字段是 other,不是 27B 那样的 apache-2.0。
对本地用户,现在到手的是 Apache 2.0 的 27B 稠密多模态模型;云端托管版的状态,模型卡上写的是 "The service is coming soon."