AREX Feed Article
Salesforce 在 Dreamforce 发布首个推理模型 Koa:基于 Nvidia Nemotron,称训练未用真实客户数据
9 月 15 日,Salesforce 在本周的 Dreamforce 大会上发布公司首个推理模型 Koa。据 ,Koa 基于 Nvidia 的开源权重模型 Nemotron 构建,由两家公司联合后训练(post-trained),面向销售、营销和客服类任务;报道称它是本周 Dreamforce 最重大的发布之一。
按 的说法,Koa 是 Salesforce 的「首个 CRM 推理模型」。Salesforce 称它没有使用任何真实客户数据,训练语料全部来自模拟客服与销售场景的合成数据(synthetic data);在 Agentforce 平台中,它将作为前沿模型之外的替代选项,用来减少把多步推理任务交给前沿模型时的 token(模型处理与计费文本的基本单位)开销。TechCrunch 同时提到,Salesforce 并未放弃 Anthropic 或 OpenAI,它与 Anthropic 的合作 Claudeforce 仍在推进。
底座:Nvidia 的 Nemotron 3 Super
Salesforce 的新闻稿称,Koa 是在与 Nvidia 的深度技术合作中对 Nemotron 3 Super 做后训练得到的;TechCrunch 的表述是两家公司合作完成了后训练。训练使用的是一套专有的合成数据集,其建模对象是 Salesforce 近三十年的 CRM 部署经验,也就是企业实际运转的流程、工作流与运营政策。
Nemotron 3 Super 是 Nvidia :总参数 1,200 亿,推理时激活 120 亿,采用混合专家(MoE)架构,上下文窗口 100 万 token,面向多智能体工作流,以宽松许可开放权重。
Koa 的后训练方法是监督微调(SFT)加上基于 Group Relative Policy Optimization(GRPO)的强化学习,工具来自 Nvidia 的 NeMo RL、NeMo Gym 和 NeMo AutoModel。Salesforce 称自己掌握模型权重,后训练与推理都在公司自有的信任边界(trust boundary)内完成。
Salesforce 主席兼 CEO Marc Benioff 在新闻稿中说:「Salesforce 造出的最有价值的东西不是我们的平台,而是关于企业如何运转的长期积累。Koa 把这些知识放进了模型本身。」
Salesforce AI 执行副总裁 Jayesh Govindarajan 则对 TechCrunch 解释了此前没有这样做的原因:Salesforce 一直想训练自己的企业级前沿模型,障碍是缺少一个可用的预训练底座。「在 Nemotron 出现之前,没有一个既可用、又达到最先进水平、还有清晰数据来源的美国主权预训练模型。我们不知道 Qwen 是用什么训练的。」Qwen 是阿里巴巴的开源权重模型。
训练语料来自模拟的客服与销售现场
Salesforce 称,Koa 的语料完全由合成场景构成,覆盖生成线索、评估商机、解决服务工单等客户生命周期任务。场景横跨 14 个以上行业,包括制造业、金融服务、医疗健康和旅游;每个场景把一个人设(persona)与具体任务配对,再映射出 agent(智能体)完成任务所需的动作与工具调用序列。
Govindarajan 向 TechCrunch 描述了模拟现场的细节:「我们实际上模拟了一个客服环境,有客服专员的角色,包括打电话进来的愤怒客户;一直延伸到试图完成交易的销售专员。」
TechCrunch 列出的卖点之一是:Koa 没有摄入任何真实客户数据,因此无法把数据泄露给其他方。按 Salesforce 的说法,Koa 的权重由 Salesforce 控制、完全运行在自有基础设施内,客户数据不会越过信任边界;模型以「温度 0」运行,使回答稳定可复现,另有专门的服务框架(serving harness)叠加信任与安全控制。
在 Agentforce 中替代前沿模型,省的是 token
TechCrunch 描述了此前的流程:如果一个 agent 需要推理长时间、多步骤的任务,提示会经由 Agentforce 的 AI 网关(决定哪个请求交给哪个模型的系统)路由给 Claude 或 ChatGPT 之类的前沿模型。Koa 的定位就是在 Agentforce 中承接这类任务,用更少的 token 完成同样的工作,降低 AI 支出。客户在 Agentforce 上搭建 agent,处理答复客服问题、安排预约这类日常任务。
Nvidia 负责企业生成式 AI 软件的副总裁 Kari Ann Briski 对 TechCrunch 说:「我们有一套独特的推理架构,可以做到 token 高效……主权 AI、首 token 时间、高效推理,要把 token 经济性做好,需要的差不多就是这三样。」
客户可以在三个层级选用 Koa:Data Cloud 生成式模型目录中的托管 LLM(大语言模型);Setup 中面向全组织的模型提供商(产品页称它是第四个提供商选项);以及 Agentforce builder 里按 agent、子 agent 粒度指定。
Salesforce 用自家基准 CRM Bench 衡量 Koa:新闻稿称它在更新商机、流转工单、安排跟进等真实任务的 CRM 动作上达到或超过领先模型,同时错误数量只有领先模型的三分之一。产品页给出的对比是:与当前默认的通用智能模型相比,Koa 调用正确动作的精确度高 11%,对客户上下文的回忆可靠性高 2.1 倍,长对话中记住上下文的能力高 15%。这些数字都出自 Salesforce 自家的基准与产品页面。
另一条线:与 Anthropic 的 Claudeforce 合作
TechCrunch 在 Koa 的报道中提到,Salesforce 并没有放弃 Anthropic 或 OpenAI:它与 Anthropic 名为 Claudeforce 的合作(TechCrunch 写作 ClaudeForce)允许企业把 Claude 作为 AI 界面使用,数据仍留在 Salesforce 的记录系统中,由其基础设施保护。
这项合作在 8 月 26 日公布,比 Dreamforce 早约三周。按 ,它是双方「扩展的战略合作」:首批交付物是 Claude 内的 Salesforce 插件,带 37 项预置销售技能,覆盖会议准备、交易健康度检查和管道复盘;Claude 同时进入 Agentforce,作为 Atlas 推理引擎的推理模型之一,默认驱动 Agentforce Vibes 和 Agentforce Coworker,并可在 Agent Builder 中使用。Salesforce in Claude 目前面向选定试点客户,预计 2026 年 9 月开放公测,更多预置技能将在 2026 年晚些时候推出。
内部先用上,六家客户进入试点
Koa 已经先在 Salesforce 内部投入使用,包括 Slack 中一个帮员工查找信息、处理日常事务的 agent。新闻稿列出的试点客户有六家:1-800Accountant、Baxter Credit Union、Engine、Formula 1、UChicago Medicine 和 Xero。
1-800Accountant 首席战略官 Ryan Teeples 在新闻稿中说:「会计工作需要在税务规则、财务数据、文档和每个客户的具体情况之间周旋。Koa 让我们的 agent 一步步推理这种复杂性,并在过程中调用正确的工具。」
同一份新闻稿还称,Salesforce 正把 Nemotron 系列模型和 Nvidia 的加速计算带进面向政府与受监管机构的 Missionforce:这类客户需要掌控模型与训练数据,把系统部署在私有云、涉密网络乃至完全物理隔离(air-gapped)的环境中。Missionforce Operations 现已在美国区域正式可用;后训练的 Nvidia 模型将在 2026 年 10 月提供给部分客户。
Koa 本身目前只向部分试点客户开放,在 Agentforce 中使用;正式可用(GA)预计在 2026 年冬季于美国区域上线。