AREX Feed Article
Crusoe 与 Thinking Machines Lab 达成每年 6,500 万美元推理协议:Inkling、GLM 5.2/5.3 生产推理将跑上专属 B200 集群
2026 年 9 月 23 日,AI 基础设施公司 ,与 Thinking Machines Lab 达成一项每年 6,500 万美元的推理算力协议。这家 AI 实验室将通过 Crusoe Cloud 上的 Crusoe Managed Inference 服务其生产推理负载,包括 Inkling 模型、GLM 5.2 与 5.3,以及实验室自己的微调变体;承载它们的是一套专属的 Tailored Deployment——由 NVIDIA HGX B200 系统组成、节点间以 NVIDIA Quantum-2 InfiniBand 网络互联的集群。
新闻稿同时给出一个业务数字:Crusoe 称,上线不到一年,Crusoe Managed Inference 的合同化 ARR(annual recurring revenue,年度经常性收入)已突破 1 亿美元。同日,独立报道了这笔交易;协议金额与 ARR 数字目前均出自 Crusoe 一方的新闻稿,未经独立审计。
工作负载清单:Inkling 之外,还有 GLM 5.2/5.3
Thinking Machines Lab 将把一系列生产工作负载——即模型上线后持续对外服务的负载——放上 Crusoe Managed Inference,清单包括其 Inkling 模型、GLM 5.2 与 5.3,以及实验室自己的微调变体。新闻稿将 Inkling 明确写作实验室自有模型,GLM 5.2/5.3 的开发方则未写明。
Tailored Deployment:Crusoe 直接运维、SLA 保障的专属端点
按新闻稿的说法,这套集群为高吞吐、高性价比的规模化推理而设计;Crusoe 将直接运行并支持它,交付形态是专属、经过基准测试、有 SLA(service-level agreement,服务等级协议)保障的推理端点。对 Thinking Machines Lab 而言,新闻稿称这带来了性价比与扩容余量,同时实验室不必自己管理推理技术栈。
按新闻稿「关于 Crusoe」部分的介绍,Crusoe 自我定位为一家「AI 工厂公司」,业务横跨大规模能源利用、AI 优化数据中心与 AI 云平台。
ARR 数字的边界:客户名单与计算口径未公布
新闻稿把这次合作放进一个业务里程碑:Thinking Machines Lab 加入的客户名单,已将 Crusoe Managed Inference 的合同化 ARR 在上线不到一年内推过 1 亿美元。名单上的其他客户是谁、这一数字如何计算,新闻稿均未说明。
“从评估到生产很快”:两位负责人的表态
Thinking Machines Lab 的机器学习基础设施负责人(ML Infra Lead)Myle Ott 在新闻稿中说:“Crusoe Managed Inference 让我们从评估很快走到了生产,并且达到了我们对自己系统的标准,给了我们把资源重新投入核心研究所需的规模和经济性。”
Crusoe Cloud 产品管理高级副总裁 Erwan Menard 则表示:“Thinking Machines Lab 有一支非常成熟的工程团队,随着规模扩大,他们期望合作伙伴达到自己的高门槛。我们的 AI 工程师团队构建 Crusoe Managed Inference,就是为了把高性价比、可靠的基础设施、推理和模型生命周期工具做成服务,让创新公司能依靠我们的专长,在生产环境中大规模运行自己选定的模型。”
下一步:拟将批量推理用于大规模合成数据生成
两家公司还在新闻稿中表示,计划把合作扩展到批量推理(batch inference),用于大规模合成数据生成,并称这将「让推理成为研究的飞轮」。目前尚无落地细节。
已被独立证实与仍待核实的部分
交易本身有两个来源交叉印证:除 Crusoe 的新闻稿外,The Information 于太平洋时间 9 月 23 日上午 7 时 01 分发出的《AI Agenda》通讯(Stephanie Palazzolo 撰写)以「Crusoe 与 Thinking Machines Labs 达成算力协议」为题报道了此事。该通讯正文位于付费墙后,本篇引用的金额与 ARR 细节无法从其正文核实。
新闻稿未披露的细节还包括:部署地点、集群的 GPU 数量、合同期限,以及每年 6,500 万美元之外的任何财务条款。