AREX Feed Article
ChatGPT 移动端语音代理功能分层推送:Plus/Pro 可在 Work 标签建文档、调用云浏览器,Free/Go 获插件与连接应用
据 9 月 23 日报道,OpenAI 周三宣布把语音代理功能带到 ChatGPT 移动端,这次推送按订阅档位分层:Plus 和 Pro 订阅者可以在手机的 ChatGPT Work 标签里用语音创建文档、调用云浏览器,并访问财务等区域;Free 和 Go 用户则可以使用插件和连接的应用。语音对话也将获得更丰富的文本输出,并支持在文本与语音之间切换、从手机续接到桌面继续。
图片来源:TechCrunch 报道配图
这次移动端更新承接 OpenAI 同日的官宣。北京时间 9 月 24 日凌晨(美东时间 9 月 23 日中午),OpenAI 官方账号在 宣布 ChatGPT Voice 升级,称语音可以使用邮件、日历、Slack 等插件,由 GPT-6 Astra、Sol 与 Luna 驱动,并可在网页与移动端的 ChatGPT Work 中用语音创建文档、幻灯片、网站与表格,或在浏览器中处理复杂任务,功能「今日起在全球推送最新版 App」。截至北京时间 9 月 24 日上午,这条帖子获得 9,531 个赞和约 158 万次浏览。但那条推文没有说明功能如何按订阅档位分配,TechCrunch 的报道把这部分范围写了出来。
分层细则:Plus/Pro 的手机 Work 标签还能起草邮件、总结 Slack、建站做演示
TechCrunch 把这次推送的范围落到具体操作:Plus 和 Pro 用户在手机上的入口是 Work 标签,可以创建文档、起草邮件、总结 Slack 消息,也能建网站、做演示、使用云浏览器,并访问 ChatGPT 中财务等其他区域。Free 和 Go 用户得到的则是插件与连接的应用。
语音对话的三项改进均出自 OpenAI 的说明
除分层之外,OpenAI 还表示 ChatGPT 的语音对话将有更丰富的文本输出;用户可以在文本与语音之间轻松切换,也能把在手机上开始的对话带到桌面继续。对在路上用语音交代任务的人来说,这意味着同一件事回到桌面不需要重新开一段对话。
Anthropic 一周前合并聊天与工作界面,OpenAI 目前仍把两者分开
TechCrunch 把这次发布放在与 Anthropic 的对照里:Anthropic 最近让手机与桌面之间的交接更容易,并在 。合并后,用户可以在一个窗口里访问聊天、Cowork 与 Artifacts;Anthropic 同时新增演示与文档功能,支持在桌面开始创建文档、用手机查看进度,这些能力先面向 Pro 与 Max 计划推出。
TechCrunch 同时指出,OpenAI 仍然把聊天与工作区分开:用户在 ChatGPT 里仍需自己判断该进哪个标签。Anthropic 合并界面的初衷正是解决这类困惑,该公司当时的说法是,客户常常搞不清该用哪个标签做什么任务。
从桌面先行到移动端跟进:7 月的手机版语音还不能执行操作
7 月 8 日,OpenAI ,介绍其为全双工模型、支持自然打断;公司当时还提到,超过 1.5 亿人已在通过 Voice、Dictation 等功能与 ChatGPT 说话。,ChatGPT Voice 接入桌面应用:用户能用语音在 Work 标签完成任务、在 Codex 标签构建应用,桌面端还支持下达涉及多个步骤的复杂指令;OpenAI 的演示视频里,开发者一句话让 ChatGPT 新建线程、提交 pull request 并定位一个 bug 的根因。但手机端当时被排除在外:TechCrunch 的报道写道,手机版语音对话更顺畅、打断处理更好,却「并不是为在手机上执行操作而构建」。
9 月 23 日的报道把这次推送描述为「把类似能力带到移动应用」。TechCrunch 给出的背景是,越来越多用户正在转向用语音向 AI 助手下达复杂任务的指令。
目前还有两处空白:TechCrunch 的报道没有说明各功能何时覆盖所有符合条件的用户,推送节奏只有官方推文「全球今日起推送」一句;语音由哪些模型驱动,也只有推文里「由 GPT-6 Astra、Sol 与 Luna 驱动」的表述,报道没有涉及模型细节。