AREX Feed Article
华为开源 openPangu 2.0 Pro:505B 参数全昇腾训练、512K 上下文,许可证明令禁止欧盟使用
7 月 31 日,华为正式开源 openPangu-2.0-Pro 模型权重、基础推理代码与技术报告。该模型是 openPangu 2.0 系列的最新旗舰版本,总参数约 505B(MoE 架构,每 token 激活约 18B),支持 512K 上下文窗口——在目前已开源 MoE 模型中为最长。训练全程基于华为昇腾 NPU,未使用 NVIDIA GPU,成为迄今最大规模的完全非 NVIDIA 算力训练的开源大模型。
模型架构与技术亮点
openPangu-2.0-Pro 在架构层面实现了多项自研创新:
- 分层混合注意力:沿用高效 MLA(Multi-head Latent Attention),并采用 DSA(动态稀疏注意力)+ SWA(滑动窗口注意力)独立分层混合架构,层配比为 1:2。SWA 层负责局部窗口建模,DSA 层负责稀疏全局聚合,在保持精度的同时显著降低长序列推理的计算与访存开销。
- 4 支流 mHC 拓扑:将传统残差连接升级为流形约束超连接(mHC),提升表征多样性与泛化能力。
- 3 头 MTP 自投机解码:一次额外预测 3 个 token,加速推理。
- Muon 优化器:训练中采用 Muon 优化器以获得更快收敛速度。
预训练数据总量约 34T tokens,分为通用领域(25T)、推理能力培养(8T)、退火处理(1.4T)三个阶段。后训练阶段完成快慢合一监督微调(SFT)、多专项强化学习(RL),并通过在线策略蒸馏(OPD)完成能力融合。
自报基准:无第三方对照,复杂软件工程仍有差距
华为在技术报告中仅披露了 openPangu-2.0 系列模型自身的测评数据,未附上与第三方模型的直接对比结果。官方自报的核心分数(Thinking 模式,均为三次运行均值)如下:
- SWE-bench Verified:68.5
- LiveCodeBench V6:85.7
- AIME 2026:95.4(Avg@16)
- GPQA-Diamond:87.9(Avg@4)
- HMMT Feb 2026:86.2(Avg@16);配合 Python 工具升至 93.2
技术报告同时坦言,模型在处理复杂现实世界软件工程任务时,仍与顶尖模型存在明显差距。目前上述分数尚无独立第三方复测结果。
昇腾原生推理栈 omni-infer 同步开源
与模型权重同步,华为开源了昇腾原生的推理框架 omni-infer(Apache 2.0 许可证),部署代码托管于 GitCode(ascend-tribe/openPangu-2.0-Infer)。该框架自研多款融合算子,搭配 Felix 上下文并行、单核多流执行等策略,深度适配 Ascend 910C 硬件。华为披露,在 128K 上下文下,openPangu-2.0-Pro 最低 TPOT 时延 9.55ms,TPOT 20ms 条件下单卡 NPU 生成吞吐 1326 token/s。
自定义许可证:禁用欧盟,要求标注出处
openPangu-2.0-Pro 模型权重采用自定义的 OpenPangu Model License Agreement Version 2.0,而非标准开源许可证。该协议明确禁止在欧盟境内访问、下载、部署或使用该模型(第 3.1 条),并要求基于该模型的产品或服务在相关页面标注 "Powered by openPangu" 及华为商标声明(第 4.2 条)。
这与 omni-infer 推理代码采用的宽松 Apache 2.0 许可证形成鲜明对比,使得 openPangu 在许可层面的开放程度明显低于 Qwen3 等采用 Apache 2.0 的模型。
此外,模型卡标注参数为约 505B,但 Hugging Face 自动元数据报告为 541B,仓库未对两者差异作出解释。模型文件总大小约 1.08 TB。
战略背景:以开源验证昇腾垂直整合
openPangu-2.0-Pro 的发布不是孤立事件。今年 6 月的华为开发者大会(HDC 2026)上,余承东宣布 openPangu 2.0 计划从 6 月 30 日起陆续开源 7 大组件(包括预训练代码、后训练代码、训练算子),并已率先于 6 月 30 日放出 92B 总参/6B 激活的 openPangu-2.0-Flash。
在国产 DUV 量产推进与美国对华芯片出口管制持续博弈的背景下,这一发布向外界传递了明确信号:华为已具备从昇腾芯片、CloudMatrix 384 超节点集群、模型训练到云端部署的完整垂直能力,无需依赖 NVIDIA 生态即可训练并交付 500B 级 MoE 模型。
余承东在 HDC 期间坦言,华为将大量 AI 算力分配给了国内其他企业需求,自身留存的算力"非常有限",因此更聚焦于时延和吞吐率的效率优化。这一现实约束,反而塑造了 openPangu 以稀疏性和推理效率为核心的设计哲学。
openPangu 能否在华为生态之外获得广泛采用,取决于开发者社区的复测验证、昇腾硬件的可及性,以及欧盟禁令对潜在用户群的实际影响。
来源
- — 官方模型卡、架构说明与测评结果
- — 许可证全文
- — 架构细节、训练流程与推理性能数据
- — 开源公告与余承东表态
- — 参数规模差异、许可证分析及产业定位
- — 开源背景与 HDC 2026 计划回顾
- — 昇腾原生部署指南与 Apache 2.0 许可证