AREX Feed Article
魔芯MoWorld-3D发布:28B MoE全栈昇腾,成本砍掉七成
7月16日,WAIC 2026开幕前一天,国家人工智能应用中试基地(具身智能)联合华为、魔芯(杭州)科技有限公司在杭州发布。魔芯创始人陈天润与华为云浙江总经理尧鹏之当场宣布模型上线华为云,向全行业开放。
这是的三维世界模型。28B参数MoE混合专家架构,全栈基于昇腾NPU集群运行,推理综合成本仅为同等规模进口GPU方案的30%。
一天后,MoWorld-3D在WAIC展台前排起长队,当日在现场记录了这一场面。观众上传一张街景照片,几分钟后便在一个完整的3D世界里自由行走、转身、环视——每栋建筑、每条街道、每个物体的空间关系都保持真实物理逻辑。
华为云当场宣布上线,00后创始人放话"两年三年内出ChatGPT时刻"
华为云浙江总经理尧鹏之在称,MoWorld-3D的诞生"正是华为昇腾云从训练到推理一站式全栈能力的有力印证",为AI认知复杂物理世界"提供了全新的选择"。
魔芯科技创始人兼CEO陈天润——师从潘云鹤院士的浙大直博生、2000年出生——在会后接受采访时明确表示,世界模型的"ChatGPT时刻""可能两年到三年就会完成。看谁做得快,我希望是魔芯。"
杭州滨江区常务副区长高翀在致辞中披露了一组数据:2025年全区人工智能产业规模达478.3亿元,占杭州全市的47.3%。滨江依托全国唯一的具身智能国家级中试平台,已率先形成先发优势。
当天发布会现场,传化集团、联想控股、现代汽车、吉利集团、华策影视等近150位产业界代表到场。
2026年,260亿元砸进世界模型赛道
2026年被业界称为""。年初,李飞飞创办的World Labs完成10亿美元融资;图灵奖得主杨立昆创立AMI Labs专攻这一方向。截至7月,国内已有超过30家以"世界模型"为核心概念的创业公司,累计融资超260亿元人民币。
魔芯科技并非横空出世。公司2021年成立于杭州,早期做消费级3D打印,积累了海量3D资产和建模工具。2025年12月,魔芯在华为(杭州)全球培训中心推出原型,完成技术可行性验证。2026年7月7日,发布——14B参数MoE架构,在昇腾NPU上跑到50FPS实时交互推理,技术报告同步上线。
MoWorld-3D正是基于这个基座的升级:架构、性能、工程化能力全面强化,从实验室原型跨入规模化落地。
28B MoE全栈NPU:凭什么把成本压到三成
MoWorld-3D采用28B参数MoE混合专家架构,全栈基于昇腾NPU集群运行。推理综合成本仅为同等规模进口GPU方案的30%。
50FPS的实时帧率来自魔芯与昇腾团队长达一年多的联合攻关。双方围绕昇腾AI基础软硬件,完成了多NPU协同调度优化、注意力计算轻量化、混合精度量化、生成算子融合等多层改造。
训练阶段引入超密集注意力并行和长序列Token并行策略,实现2000帧超长序列训练。推理阶段通过流水线执行、层级化序列并行及动态混合精度量化,将场景解码与主干生成任务拆分至多卡并行。
用户可通过图像或文本输入,生成一个具备完整空间结构且支持六自由度相机运动的3D场景。在生成的世界里用W/A/S/D操控行走,场景中建筑结构、道路走向、物体位置均保持空间一致性。
陈天润用数据说明差距:"过去用传统方法建模,至少需要几天甚至数周。现在用世界模型,几分钟之内就能得到一个完整三维空间。在实现同样效果的基础上,成本差距可达20倍。"
MoWorld-3D的训练数据来自魔芯自建的3D原生数据引擎,覆盖真实世界与虚拟世界多种场景,经几何一致性、轨迹精度、多视图稳定性等多维筛选。
这套数据体系源自魔芯此前在3D打印和三维物体生成领域积累的数年资产,在3D数据仍属稀缺资源的当下,构成了难以快速复制的壁垒。
世界模型还没有标准,国产NPU第一次站上起跑线
世界模型的全球竞争格局尚未定型。谷歌DeepMind已推出Genie 3,但主流方案的推理帧率普遍低于30FPS,且几乎全部围绕英伟达GPU构建。魔芯选择了全栈国产NPU。
资本先于行业共识做出了判断。魔芯科技累计完成近10亿元人民币融资,投资者包括华为旗下哈勃投资、联想旗下联融志道,以及头部美元机构和国家战略储备基金。
MoWorld-3D的差异化不止于国产替代。上线华为云当日,即与杭州具身智能中试基地启动"未来数字城市基础设施"共建项目,把世界模型能力注入交通仿真、应急推演、城市数字孪生。
陈天润在采访中透露,魔芯已在影视制作、具身智能、自动驾驶等领域同步推进落地:"在街道重建场景中,过去需要大量人力对一个街区反复航拍、渲染,效果不佳还得推倒重来。"
窗口不会一直开着
世界模型的标准还没有人定下来。对国产团队而言,这意味着一个少见的窗口——不是追赶,而是参与定义下一代空间智能的技术标准。
MoWorld-3D在这个窗口期给出的答案很具体:第一个全栈国产NPU世界模型,50FPS实时交互,推理成本压到GPU方案的三成。陈天润把这种高帧率实时交互称为"Flash World Model"。他说得直白:"高帧率才能保持世界模型在真实场景中可用。"