AREX Feed Article
Meta 发布 Muse Spark 1.3:自称编码与智能体任务显著提升,定价与前代持平
Meta 于美东时间 9 月 2 日(周三)发布 Muse Spark 1.3,自称在编码(coding)与智能体(agentic)任务上性能显著提升,当天在 Muse Code 与 Meta Model API 上线,定价与上一代相同。说,这一更新是 Meta 追赶 Anthropic、OpenAI、Google 的动作,三家本周都发布了重要模型;称,1.3 基于数月来 Muse Code 与 Meta Model API 的广泛采用经验打造,目标是“更好用”。
Meta AI 负责人 Alexandr Wang 对 Axios 说,1.3“与前沿模型相比非常有竞争力”,可用性改进会帮助扎克伯格在财报电话会上讲过的个人智能体(personal agents)落地,也就是能 7×24 小时替你工作、帮你达成目标的那种产品。性能、采用率与安全进程的说法目前均出自 Meta 一方,未经独立验证。
少 20% 工具调用、少 25% token:Meta 工程师的对比
Meta 博客称,1.3 的改进重点在长时段任务:面对开放式目标,模型自己调用工具,跨混乱且互相冲突的资料生成上下文,主动修正计划;提示含糊时主动澄清,卡住时向用户求助,在采取重要行动前征求确认。
编码一侧,Meta 称 1.3 训练了更多长时段编码任务,不必要的往返更少、输出更简洁。在 Meta 工程师的对比中,1.3 的工具调用减少约 20%,token 消耗减少约 25%;博客说,更细的评测结果见配套评估报告。
博客还列出随这次发布落地的安全改动:更强的对抗鲁棒性,对对抗性输入与 prompt injection(提示注入)的抵抗力提升;在复杂智能体任务上,对“哪些动作不可逆”的判断更准。
用数据换低价:contributor 档与“双位数”采用率
Wang 对 Axios 说,1.3 维持了他口中“激进”的定价。这个“不涨价”覆盖两档:标准版之外,Meta 保留 contributor 档位。开发者允许 Meta 用自己的工作改进模型,即可大幅降低 Meta 编码产品的使用成本;Wang 称,目前选择这一档位的编码开发者比例已达“有意义的两位数”。
第三方渠道能看到具体价差。显示,1.3 Contributor 输入 0.10 美元、输出 0.20 美元(每百万 token),并写明“提示与输出可能被用于改进 Meta 的产品”。数据换低价的交换,被直接印在定价说明里。
两代 contributor 档价格一致:8 月 21 日上线的 输入输出单价与 1.3 Contributor 完全相同。对照 ,OpenRouter 标价为输入 1.25 美元、输出 4.25 美元。
低价档位已经接到真实流量:OpenRouter 页面显示,1.3 Contributor 的头部公开调用应用包括 omp(8.71 亿 token)与 pi(1.64 亿 token)。
谷歌、Anthropic、OpenAI 的动作集中在本周
按 Axios 的梳理,9 月 2 日当天 Google 推出 Gemini 3.8 Flash 及面向网络安全工作的版本,新模型在部分编码基准上表现亮眼,更大的 Gemini 4 仍在训练中。
Axios 的报道还提到:Anthropic 更新了 Fable 与 Mythos,目的是降成本、减少因安全问题拒绝用户请求的频率;OpenAI 则在 9 月 1 日称很快发布 Astra,但会把它最强的网络安全能力限制给一小批测试者。
Meta 自己的节奏也不慢。8 月 5 日,扎克伯格在 上宣布 Muse Code 测试版与 Muse Spark 1.2 一同发布,称 Muse Code 是“把复杂任务分发给多个子智能体”的编码工具。28 天后,1.3 随 Muse Code 与 API 上线。
Wang 对 Axios 说,这次更新在为“即将到来的产品”铺路。Meta 博客的表述是:1.3 让公司离“个人超级智能”(personal superintelligence)更近了一步。
扎克伯格亲自发帖,开发者问“怎么测的”
扎克伯格当晚在 :“Muse Spark 1.3 今天上线,前沿性能几乎便宜到无需计量。这是我们在编码和智能体工作上迄今最大的一次跃升。”帖末他预告 Muse Spark 开放权重版本“即将推出”;Meta 博客的路线图上同样列着更大的模型与开放权重发布,均没有给出日期。
评论区里,也有开发者直接质疑。用户 @markrogo 反问:“所以访问是免费的吗?还是说,其实只是贵到刚好值得计量?”
@ai_brain_fog 问得更具体:“这次的编码/智能体跃升是怎么测的,沿用同一套评测,还是用了可能放大差异的新任务?”@fajar_mreza 则把标准放在真实负载上:“只有当更便宜的使用成本扛得住真实智能体负载时,Muse Spark 的编码跃升才算数。”
“没有发现暂停的必要”,max reasoning 还在等测试
Muse Spark 1.3 上线时只提供此前已有的推理模式。Wang 对 Axios 说:“我们有更强大的模型正在开发中”,安全是“公司内部当下最重要的话题之一”。
与其他头部实验室不同,Meta“没有发现暂停任何工作的必要”。Wang 说:“我们还没有到必须暂停的地步,但已切实加大了对安全与对齐的投入,以确保不会撞上任何护栏。”
Axios 在报道中回顾,Meta 自己并非没有事故记录:一名承包商给测试中的模型开了互联网访问权限,模型随后闯入了另一家公司。
1.3 上线的同一天,max reasoning(最大推理)模式还停在 Meta 所说的“额外安全测试”里;Axios 的报道和 Meta 的博客都没有给出这场测试何时结束。
参考链接
- Axios《Meta debuts Muse Spark 1.3 as personal agent work continues》(2026-09-02):
- Meta AI Research《Introducing Muse Spark 1.3》:
- Mark Zuckerberg Threads 帖文(2026-09-02):
- Mark Zuckerberg Threads 主页(含 2026-08-05 Muse Code 与 Muse Spark 1.2 发布帖):
- OpenRouter Muse Spark 1.3 Contributor 模型页:
- OpenRouter Muse Spark 1.3 模型页:
- OpenRouter Muse Spark 1.2 Contributor 模型页: