AREX Feed Article
Grok Bot 开测:月付 $120,SpaceXAI 把 AI 队友塞进了你的工具里
8 月 11 日,SpaceXAI 旗下账号 在 X 平台宣布 Grok Bot 进入早期 beta 测试。公告称 Bots 是"替你干活的 AI 队友":它们登录用户已有的工具和软件、像用户本人一样操作,完成工作后才回来。
Grok Bot 即日起对 SuperGrok Heavy($300/月)、Cursor Ultra($200/月)和 Cursor Teams Premium($120/座/月)订阅用户开放,覆盖 macOS、Windows、Linux 和 iOS,Android 版本和企业版均标注为"即将推出"。
Lenny Rachitsky 直呼"好久没这么兴奋",Matt Shumer 却说模型路由"不太行"
产品上线仅数小时,评测圈的反馈来得又快又直接。
知名产品播客主理人 在 X 上写道:"我好久没对一款 AI 新品这么兴奋了。它就像 OpenClaw,但超级简单、可靠,用起来没那么吓人。"他列举了自己已经在用的四个场景:为求职者和招聘方做匹配、自动回复客服邮件、扫描信用卡账单找可取消的订阅、为播客嘉宾生成简报。
AI 创业者 自称测试了数周。他设置了一个研究者 Bot、一个写作者 Bot,再加一个"幕僚长"Bot 协调二者协作。"我以为肯定会崩,结果开箱即用。"他的总结是"面向一切的 agent,不只是代码"。
但 Shumer 也给出了明确的批评:Grok Bot 不允许用户选择底层模型,所有任务由后端自动路由。"模型路由器在我测试时不太行,"他说,随后补充团队告诉他此后已有改善。SpaceXAI 的和均未披露路由使用了哪些模型。
从内部实验到公开 beta:SpaceXAI 先把自己变成了 Bot 的试验场
Grok Bot 最初是 SpaceXAI 的内部原型,随后在公司各部门蔓延开来。销售团队拿它做外呼线索研究和 CRM 更新,运营团队用它处理新员工入职和 Gmail 发票报销,工程团队让它复现产品 bug、提工单、再把修复任务转给调试 Bot。
SpaceX 在今年 6 月 。Grok Bot 的定价套餐直接绑定 Cursor Ultra 和 Cursor Teams Premium,而非独立计费。
Grok Bot 入场的竞争格局:Anthropic 自 2024 年起通过 Claude 的 Computer Use 能力让模型操控屏幕和键鼠,今年初又推出了面向白领的 Claude Cowork。OpenAI 在 4 月赋予 Codex 控制其他软件的能力,随后发布了可连接第三方应用的 Workspace Agents 和面向长周期任务的 ChatGPT Work。
Bot 有自己的一台电脑,而且可以组队干活
Grok Bot 的核心架构差异在于每个 Bot 拥有一台独立的云端"电脑"——即一个持久化的虚拟工作环境。这台电脑在用户合上笔记本后继续运转,Bot 可以登录应用和网站(包括没有 API 或 MCP 接口的平台),通过图形界面操作完成任务。
官方产品负责人 Roman 在博客中的表述是:"大多数 AI 能把你带到 90%,Grok Bot 能完成最后那一下——因为成果直接落到了人本该放它的地方。"
多 Bot 协作是另一项区别于单 agent 产品的设计。用户可以将多个 Bot 放入同一个群聊对话,它们自行传递任务、分配归属、仅在需要决策时叫人。SpaceXAI 内部已有员工在实践中使用"幕僚长"Bot 管理一组专业 Bot,分管收件箱、招聘、报销、bug 修复和运营。
Bot 还可以通过"旁观看你干活"来学习工作流。用户操作一次,Bot 将其保存为 routine;下次同一步骤由 Bot 独立执行,用户只需审核结果。
Sales 团队的 Bennett 在公告中称,给 Grok Bot 展示过一次工作流后,"现在我对它完全信任,效率大概提升了 2-3 倍"。Operations 团队的 Emma 则描述了从"每 15 分钟检查一次"到"放它自己干、越干越好"的信任建立过程。
Agent 市场从"问答"转向"干活":三条路,一个赌局
在 Grok Bot 之前,AI agent 的主要形态是"回答问题的助手"。Claude 可以写代码、改文档,ChatGPT Work 可以做多步骤任务,但它们的基本交互模式仍然以用户发起、AI 响应为主线。Grok Bot 试图走另一条路:把 agent 包装成有名字、有职责、持续运转的"数字同事"。
定价层面,Grok Bot 采用订阅制而非按 token 计费——Cursor Ultra 个人版 $200/月,团队版 $120/座/月,已包含一台 Bot 电脑、工具接入权限、routine 排程和扩展 token 额度。对比 OpenAI 等厂商在 agent 产品中引入按用量计费的模型,SpaceXAI 选择了更像 SaaS 的收费模型。
但这条路的真正考验是可靠性。聊天机器人答错了,用户改一下就好。一个自主操作 CRM、供应商邮件或客服队列的 agent 出错,后果是业务级事故。Grok Bot 的和公告均未公布 agentic 任务上的 benchmark 数据。
赌的是你愿不愿意把活交给它
Grok Bot 的早期评测在"好用"和"还不够稳"之间摇摆——产品体验收到了掌声,模型路由和认证流程收到了投诉。但它的方向表达了一个清晰的判断:AI agent 的下一个战场不是更强的推理,而是更少的监督。Bot 能不能在你不看的时候也不出错,决定了它是一款真工具,还是一段新鲜感。