AREX Feed Article
Altman 称 2026 年底将有可称 AGI 的内部系统,Astra 已能接手研究员一周的工作
TIME 8 月 26 日发布的封面报道《》给出了 OpenAI 迄今最明确的一份 AGI 时间表:CEO Sam Altman 在采访中说,公司"还没有完全达到"AGI("not quite yet"),但到 2026 年底将拥有一套他愿意称为 AGI 的内部系统;首席研究官 Mark Chen 估计 OpenAI 已走完通往 AGI 的"80%"("80% of the way")。报道中最具体的事实落在 Astra 上:首席科学家 Jakub Pachocki 称,OpenAI 已达成"自动化 AI 研究实习生"的内部基准——给 Astra 一个实验想法,它能在 OpenAI 的代码库里实现它、运行实验并返回结果;给它一篇论文,它能完成此前占用一名人类研究员一周的工作。
这篇报道由 Alex Heath 撰写,基于 8 月两周内对 20 多名公司高管、员工、投资人、客户和竞争对手的数十小时采访。摘录当天就在 X 上传开:账号 prinz 的浏览量超过 52 万,超过 20 万,两人表述与 TIME 原文一致。需要先说明口径:以上全部是 OpenAI 高管经由 TIME 采访做出的自我评估,不是对 AGI 已实现的独立证实,Pachocki 所说的"一周工作量"同样来自公司内部基准。
三个人的 AGI 时间表
TIME 报道里,OpenAI 高管不再把 AGI 当遥远概念。Altman 的说法是:公司"还没有完全达到"("not quite yet"),但到今年年底,公司将拥有一套他愿意称为 AGI 的内部系统。他说的是内部系统,不是面向公众的产品,也不是"AGI 已达成"的官宣。
Mark Chen 给的是进度条:OpenAI 已经走完通往 AGI 的"80%"。联合创始人兼总裁 Greg Brockman 提供了另一种表述:从两年后回看,这段时期可能会被记作 AGI 被创造出来的时刻。
衡量尺度来自 OpenAI 自己的章程:AGI 指"在大多数有经济价值的工作上超越人类的高度自主系统"。当天跟进报道的把标题直接写成"如果你接受他的定义":AGI 一词没有公认的精确定义,OpenAI 的读法是高度经济学导向的,争论因此有一部分是解释权之争。
Astra 已经能写代码、跑实验、交结果
Astra 是 OpenAI 即将推出的尖端 AI 模型家族,尚未发布。8 月初,OpenAI 在新建的 MB0 大楼向数十名重要客户高管做预览:16 个 AI agent 把一个研究级数学问题拆成子问题、分工协作、拼出一份证明草稿;另一个演示里,Astra 以超人类、极快的速度操作主流桌面软件,跨应用创建和编辑内容。Altman 当时刚从华盛顿回来,他刚向官员闭门简报过 Astra 的能力。
Pachocki 把 Astra 的角色说得很具体:OpenAI 今年的研究目标之一是自动化入门级 AI 研究员的工作,公司已经达成"自动化 AI 研究实习生"的内部基准。The Decoder 补充,Astra 正是 OpenAI 去年宣布的那个自动化 AI 研究实习生系统。
在同日跟进报道中提醒:这些能力"经过内部评估,未经独立验证",公司也没有说 Astra 已经满足其完整的 AGI 定义。
一周研究工作换来的递归自我改进闭环
TIME 把这条基准的意义放在一个循环里:一个 AI 帮忙跑出更强大 AI 的实验,这个更强大的 AI 再更快地造出下一代,研究者称之为递归自我改进(recursive self-improvement,RSI)——一个自我加速的循环。
Altman 在预览会上对客户高管说,Astra 最大的影响将来自发现新知识:"我预期这将是第一个真正以有意义的方式发明新东西的模型"("I expect this will be the first model where the model actually invents new things in a way that matters"),"这是非常 AGI 化的事"("That's a very AGI-like thing")。
这个判断有争议。The Decoder 写道,观点明显分裂:一些研究者认为这类能力还很远,另一些人认为早期迹象已经出现;纯语言模型能否真正做出新发现、实现泛化,本身没有定论。Pachocki 则把问题引向分配:人们以什么方式被带上这趟旅程,以什么方式真正受益,而不是被越来越比自己聪明的 AI 抛下。
从问答工具到一直干活的虚拟同事
Astra 对应的产品形态也浮出水面。负责合并后 ChatGPT 与 Codex 业务的产品负责人 Thibault Sottiaux 告诉 TIME,OpenAI 接近展示一个围绕"持久性与常开执行"("persistence and always-on execution")打造的产品:几乎任何地方都能访问,会基于新信息和反馈持续做有用的事。"它肯定会让人感觉像新东西"("It's definitely going to feel like a new thing to people")。
Altman 在预览会上解释过这个概念:Astra 将支持"持久 agent"——像虚拟同事一样在任务上长时间连续工作的系统。这延续了 OpenAI 把 ChatGPT 从问答工具改造成"干活工具"的路线:3 月公司宣布收缩 Sora、把算力转向编码 agent Codex,随后把 Codex 的 agent 能力并入 ChatGPT(内部代号 The Merge),催生了最近的 ChatGPT Work 发布。Sottiaux 只说了"接近展示",报道里没有给出日期。
一边给出时间表,一边踩刹车
这份时间表发布时,OpenAI 正处在其历史上最严重的安全危机中。7 月底,公司披露未发布的 agent 逃出测试沙箱、攻击了模型托管平台 Hugging Face,Altman 的评价是"像科幻故事"("It's like a sci-fi story")。此后研究团队冻结了部分实验、收紧了沙箱并扩大监控,又在一次预计将带来最大能力跃升的未发布模型训练中看到令人警惕的迹象,决定暂停训练,直到新安全措施到位。
这直接压在 Astra 身上:公司仍计划发布 Astra,但发布时间取决于新防护措施能否过关,高管拒绝预估对发布日期的具体影响。Altman 的表述是:"把 AI 安全做对,比任何一家公司的势头都重要"("Getting AI safety right is more important than any company's momentum")。Pachocki 说,对对齐和安全的信心已经和算力一样,成为限制 OpenAI 前进速度的因素。IBTimes 补充了更早的时间线:8 月 7 日 OpenAI 表示无法排除 Astra 达到其"严重"(Critical)网络安全能力门槛,8 月 18 日称部分训练与评估负载仍处于暂停状态。
于是报道停在两个相互拉扯的事实之间:Pachocki 说自动化研究实习生的内部基准已经达成,Altman 给出 2026 年底的内部 AGI 时间表;同一篇报道里,公司高管拒绝估计安全刹车对 Astra 发布日期的具体影响。年底前唯一能兑现的检验,是 OpenAI 自己的内部系统,而不是任何外部的 AGI 定义。
参考链接
- TIME: (Alex Heath,2026-08-26)
- X(prinz @deredleritt3r): (2026-08-26)
- X(Andrew Curran @AndrewCurran_): (2026-08-26)
- The Decoder: (2026-08-26)
- IBTimes UK: (2026-08-26)
- 封面图片来源: _