AREX Feed Article
HUMAIN 在 LEAP 2026 发布 humain-m3:基于 MiniMax-M3 的 428B 阿拉伯语大模型,即日开放预览
9 月 3 日,沙特公共投资基金(PIF)旗下公司 HUMAIN 在利雅得 LEAP 2026 上宣布 humain-m3:一个总参数 428B、采用混合专家架构(MoE)的阿拉伯语大模型,基于 MiniMax-M3 谱系构建,在超过 1 万亿 token(词元)的阿拉伯语原生内容上继续预训练。据,该模型“由 HUMAIN 委托、MiniMax 交付”(commissioned by HUMAIN and delivered by MiniMax),当天即以研究预览(research and evaluation preview)形式上线;新闻稿同时宣称,在七个公开阿拉伯语基准上,humain-m3 取得了参与对比的前沿模型中的最高平均分。
新闻稿给的时间表分两步:先以研究预览形态开放,供开发者与研究者测试反馈;安全训练与对齐完成后,再以 MiniMax Community License 发布开放权重版,目前目标为下月(10 月)。
图注:随 humain-m3 新闻稿发布的 HUMAIN × MiniMax 联合标识(来源:PR Newswire 媒体资料库)。
HUMAIN 委托、MiniMax 交付
新闻稿的标题把 MiniMax 写进了模型身世:“一款由 MiniMax 开发的(developed by MiniMax)前沿阿拉伯语模型”。正文的用词则更像一份订单:“由 HUMAIN 委托、MiniMax 交付”。口径略有不同:模型“由 HUMAIN 发布”,是在 MiniMax 原生多模态 MoE 基座之上“叠加了 HUMAIN 的阿拉伯语后训练”(Arabic post-training)。三处措辞合起来,分工很清楚:技术血统来自 MiniMax,品牌、发布与分发属于 HUMAIN。
HUMAIN 是沙特 PIF 旗下公司,官方口径覆盖下一代数据中心、高性能基础设施与云平台、先进 AI 模型和行业解决方案四大业务,模型部分“包括在阿拉伯世界开发的、世界上最先进的阿拉伯语大语言模型”,自有产品线是 ALLAM 家族;除自研外,HUMAIN 还投资并与全球领先 AI 公司合作。MiniMax 自称使命为“Intelligence with Everyone”,旗下模型与 AI 产品服务超过 3 亿用户、200 万企业与开发者,覆盖 230 多个国家和地区。
23B 激活:M3 基座上的继续预训练
HUMAIN Node 的规格页补充了新闻稿没有写的数字:humain-m3 每个 token 激活约 23B 参数。页面还称,模型保持原生多模态,可理解图像与视频输入,面向阿拉伯语与英语的长程 agent(智能体)工作流提供工具调用,带 always-on、adaptive、off 三种思考模式。这些规格与能力描述均出自 HUMAIN 自己的产品页。
基座 MiniMax-M3 是 MiniMax 今年 6 月公开的模型,技术报告于 6 月 11 日上线,权重在 开放下载。模型卡显示,M3 同样是约 428B 总参、约 23B 激活的原生多模态 MoE,上下文窗口 1M token,并引入 MiniMax 稀疏注意力(MSA);官方称相较前代 M2,在 1M 上下文下 prefill(预填充)提速 9 倍、decode(解码)提速 15 倍。
humain-m3 与 M3 的继承关系,官方用评测表直接摆了出来:对比模型里单列一列 M3 reference,把基座本身当作阿拉伯语后训练效果的参照。
七个公开基准平均 89.37%:赢五丢二
新闻稿给出的结论是:在七个公开阿拉伯语基准上,humain-m3 的平均分领先参与对比的前沿模型。具体分数在 HUMAIN Node 公布的对比表里:七个基准等权平均 89.37%,高于 GPT-5.6 SOL 的 87.30%、Opus 5 的 87.34%,以及 M3 reference 的 80.34%。
图注:HUMAIN 随新闻稿发布的对比表,humain-m3 所在列以高亮框出,加粗为各基准最高分(来源:PR Newswire 媒体资料库)。
七项单项里,humain-m3 赢下五场,涵盖核心理解、母语知识、学术考试、语言能力与真实性;输的两场是检索增强生成(94.63% 对 GPT-5.6 SOL 的 94.91%)和翻译版 MMLU(93.20% 对 Opus 5 的 93.78%)。与 M3 reference 的 80.34% 相比,阿拉伯语后训练把平均分抬高了约 9 分,HUMAIN Node 页面把这形容为“会说阿拉伯语”和“为阿拉伯语而生”之间的差别。
口径的边界写在表格脚注里:分数是 HUMAIN 对预览版 humain-m3 checkpoint(检查点)的评测,七个公开基准等权平均,各基准最高分加粗标出。这组“最高平均分”建立在厂商自选的三个参照模型与厂商自评之上:评分对象是预览 checkpoint,评分者是 HUMAIN 自己。
微软、Reflection 同周官宣,收官日发布模型
LEAP 2026 于 8 月 31 日至 9 月 3 日在利雅得举行(),humain-m3 落在最后一天。同一场会上,HUMAIN 的动作早已排开:8 月 31 日,HUMAIN 与,拟把 HUMAIN ONE 与 Microsoft 365 Copilot 打包成面向企业的“AI 生产力套装”,初期目标覆盖中东和非洲的 100 万用户,并计划 9 月 20 日起向企业发售搭载 Windows 的 HUMAIN AI PC;这建立在 8 月 26 日的第一阶段合作之上,当时双方计划把 ALLAM 模型接入 Microsoft Foundry。9 月 1 日,HUMAIN 又与构建开放模型的前沿 AI 实验室 :计划在 Reflection 首个模型年内发布后,将其部署到 HUMAIN 位于沙特的基础设施上,并探讨算力承购与后续训练、推理合作。
模型则走另一条通道。新闻稿把这次发布概括为 HUMAIN“智能战略”的两个要素:为阿拉伯语打造世界级能力,同时通过 HUMAIN Node 让前沿智能更可及。Node 页面显示,humain-m3 是第一个向预览用户开放的模型,平台上已有 100 多个来自全球领先厂商的模型,更广泛的开放“即将到来”;一个 API、一个账单,可按境内、全球或主权托管选择部署位置。
“阿拉伯语有数亿使用人口,却在前沿人工智能中明显缺席。”HUMAIN 首席执行官 Tareq Amin 在新闻稿中说,“humain-m3 是我们为改变这一点投入的成果。通过 HUMAIN Node,我们让这些能力触手可及,让开发者、研究者和创新者能够试验它、在它之上构建,并创造下一代阿拉伯语 AI 体验。”
预览已开,开放权重看 10 月
对开发者来说,模型今天就能申请使用,但入口是审批制。按 Node 页面公布的流程,通过申请的用户有两档:limited preview 提供带“沙特对齐护栏”的版本,适合日常测试,代价是增加延迟并关闭思考(thinking)与流式输出;research preview 提供完整 checkpoint,带思考、流式与更低延迟。两档共用同一套接口:网页版 Playground,或 OpenAI 兼容 API,模型名 humain-m3。预览期被官方用于在更广开放前,评估各阿拉伯语方言上的能力、安全与对齐。
预览的用途,新闻稿写得很直接:让研究者和开发者测试能力并提供反馈,为计划中的开放权重发布做准备。权重发布的窗口是:HUMAIN 预计(expects)在安全训练与对齐完成后,以 MiniMax Community License 发布模型权重,目前目标为下月(10 月)。同一许可正是 M3 权重所用的授权,MiniMax 写明,M3 的 BF16 与 MXFP8 权重以 MiniMax Community License 发布,包含署名要求、商用告知或授权要求以及禁止用途。
新闻稿没有给出安全训练何时完成,官方对权重版的表述止于“预计”与“目标下月”。在此之前,Node 页面称,预览用户的反馈将塑造后续 checkpoint 与开放权重版本。