AREX Feed Article
纳德拉宣布微软将发布 MAI 模型所依据的“Code of Conduct”并公开征求意见
微软董事长兼 CEO 萨提亚·纳德拉(Satya Nadella)9 月 13 日,微软自己的第一方 MAI 模型所依据的“Code of Conduct”(行为准则)将在“明天”发布并公开征求意见。
除了这则预告,帖文其余部分陈述纳德拉对超级智能(superintelligence)与 AI 发展路径的立场;他把这些立场与那份文件一起称为“我们正在采取的做法”。
(配图:纳德拉在微软活动上演讲,图片来自 Anadolu Agency 对这项宣布的报道。)
帖文时间戳与报道中的周一(9 月 14 日)
帖文的时间戳显示,它发布于 UTC 时间 9 月 13 日 19:36,即北京时间 9 月 14 日凌晨 3 点 36 分。帖文结尾写:“这就是我们正在采取的做法:AI 栈每一层的广泛访问与选择;企业对学习闭环与模型的控制;以及我们自己的第一方 MAI 模型所依据的‘Code of Conduct’,我们将在明天发布它,公开征求意见。”
,微软将于周一(9 月 14 日)发布这份 Code of Conduct,公开征求意见,用于约束其第一方 Microsoft AI(MAI)模型;报道把纳德拉称为“微软董事长兼 CEO”。
“第一方 MAI 模型”:微软 AI 的自研模型
“第一方”(first-party)指这些模型由微软 AI(Microsoft AI)自研。微软 AI 在 中发布了 7 款自研模型,覆盖图像、语音、转写、编程与推理:旗舰推理模型 MAI-Thinking-1;编程模型 MAI-Code-1-Flash,有 50 亿激活参数,深度集成于 GitHub Copilot 与 VS Code;图像模型 MAI-Image-2.5 及其超高效的 Flash 版本;支持 43 种语言的转写模型 MAI Transcribe-1.5;支持 15 种语言的 MAI-Voice-2,以及标注为“即将推出”的 MAI-Voice-2-Flash。
这些模型分发在 Microsoft Foundry、OpenRouter、Fireworks 与 Baseten 上。公告称:“开发者将首次能够自行微调模型的权重。”
微软 AI 把它要建的东西称为“hill-climbing machine”:一个“随着更多算力、更好的数据与更敏锐的评估,一个周期接一个周期持续改进的组织”。纳德拉帖文里让每个组织都能自建的“持续学习闭环/爬坡机器”(continuous learning loop / hill climbing machine),用的就是公告里这个说法。
同一份公告还提出“Frontier Tuning”:企业用自己的数据、在自己的环境中训练由自己控制的模型,“你的机构知识成为模型的一部分,而且仍然属于你”。8 月 12 日,微软 AI 宣布 MAI-Thinking-1 。
“不受人类控制,就不值得追求”
帖文开篇写:“对超级智能的任何追求,都必须建立在一条核心原则之上:如果我们构建的 AI 无助于人类、不在人类控制之下,那它就不值得追求。”
帖文随后提出两项主张。其一,需要“加速并广泛扩散 AI 的收益”,让收益遍及“各国、社区与公司”,这要求一个闭源与开源模型都能繁荣发展的“前沿生态”(frontier ecosystem)。其二针对企业:“企业必须对自己独特且隐性的(tacit)知识保持完全控制。”每个组织都应能建立自己的“持续学习闭环/爬坡机器”,“不必依赖任何单一模型供应商”,并能“将自身知识嵌入自己控制的模型与权重”。
“嵌入式评估者”与两天里的三次表态
帖文在谈对齐时写:“我们欢迎让对齐(alignment)成为设计目标所需的研究、专注与审慎的节奏(deliberate pacing)。我们也欢迎‘嵌入式评估者’(embedded evaluators)这样的想法,以及为让这一切不止停留在口头上而开发相应机制的更广泛努力。”随后一段强调:“关键在于,此事不能由少数实体控制,而必须在生态、国家与包括学术界在内的各领域拥有广泛代表性。”
“嵌入式评估者”的说法来自 Anthropic CEO 达里奥·阿莫代伊(Dario Amodei)。9 月 12 日,他公布新长文《We Must Pace the Frontier》。文章放慢 AI 能力提升的速度、让风险防控有时间跟上,并把“让第三方评估者拥有类似员工的持续访问权限”列为三步计划的第一步:由评估者核验安全措施是否得到遵守、报告事件、评估模型的对齐情况。他写道,Anthropic 单方面承诺执行这一步,并以 METR 为例。Amodei 给出的两个理由是:AI 构建下一代 AI 的“递归自我改进”开始出现,以及一起被他称为 OAI-HF(OpenAI-Hugging Face 事件)的智能体集群攻击事件。
同一天,大约两个半小时后,OpenAI CEO 山姆·奥特曼(Sam Altman):“我同意 Dario 的看法,我们需要放缓前沿。这是 OpenAI 最近几周讨论的一个主要议题。承诺引入具有类似员工访问权限的独立评估者是个好主意,我们也会这样做。”一天后,纳德拉发帖欢迎了同一组想法。与 Amodei 承诺 Anthropic 执行、Altman 表示 OpenAI“也会这样做”相比,纳德拉用的是“欢迎”;帖文没有说微软自己是否会引入嵌入式评估者,也没有点名任何公司或机构。
苏莱曼的回应,以及要等文件回答的问题
纳德拉发帖约 11 分钟后,微软 AI CEO 穆斯塔法·苏莱曼(Mustafa Suleyman):“这是一个再直白不过、基于常识的观点:技术的目的是服务人类、加速人类繁荣。任何做不到这一点的技术都是失败的,都应该被拒绝。”他补充说:“我们还没有走到那一步,但现在开始为这种可能性做准备是对的。”
微软 AI 自 6 月起使用的目标提法是“Humanist Superintelligence”:这类系统“旨在服务人与组织、而不是取代他们”,并“必须受人类意图塑造、对人类监督负责,并最终从属于人类目标”,“人必须始终处于控制之中”。纳德拉帖文开篇的核心原则与这套表述吻合。
至于文件里会写什么、公开征求意见以什么形式进行、它是否会为微软自己的第一方 MAI 模型设定可核验的约束,要等文件发布时才有答案。