AREX Feed Article
GPT-6 Astra 全面上线 GitHub Copilot,GitHub 称长任务更强、步骤更少
UTC 时间 9 月 4 日 20 点 24 分(北京时间 9 月 5 日凌晨 4 点 24 分),宣布,OpenAI 的 GPT-6 Astra 已在 GitHub Copilot 全面可用(generally available,GA),用户在 Copilot app、CLI 和 VS Code 里即可选用。GitHub 称,该模型专为长时程自主编码(long-horizon autonomous coding)与 agent 式任务设计。
GitHub 为这次上线给出的依据是自己的内部测试结论:模型“会边规划边验证,把诊断与验证成批处理,并在宣布任务完成前独立确认结果”,从而在长编码任务上以比此前 OpenAI 模型更少的步骤带来更强性能。这是 GitHub 自己的测试口径,不是独立基准,公告也没有公布任何具体测试数据。随推文附上的 changelog 页面写明了完整的开放范围、计费与推送方式。
十处入口同步放开,按 OpenAI 官方列价计费
把开放范围写得比推文更完整。推文只举例 app、CLI 和 VS Code,changelog 显示模型选择器(model picker)共覆盖 10 处入口:VS Code、Visual Studio、Copilot CLI、GitHub Copilot coding agent、GitHub Copilot app、github.com、GitHub Mobile(iOS 与 Android)、JetBrains IDE、Xcode 和 Eclipse。
模型面向 Copilot Pro+、Max、Business、Enterprise 四档用户开放。计费走 usage-based billing(按用量计费)模式,价格按 OpenAI 公布的官方列价(provider list pricing)执行;具体价格,changelog 让读者去查 GitHub Copilot 的模型与请求定价文档。
Business 与 Enterprise 管理员可以在 Copilot settings 的模型策略(model policy)里控制是否放行该模型。默认规则是:只要管理员没有关闭全局默认或显式禁用,新模型会自动启用。推送按渐进方式进行,changelog 提醒用户,如果暂时看不到这个模型,过段时间再回来看看。
没有 benchmark,GitHub 给了一段行为描述
GitHub 介绍的卖点是模型的工作方式,而不是分数。changelog 的原话是:在内部测试中,GPT-6 Astra 的突出之处在于它如何工作、而非产出了什么;它会边规划边验证,把诊断与验证成批处理,并在宣告完成前独立确认结果,这转化为在长时程编码任务上更强的性能,且步骤比此前 OpenAI 模型更少。
这段话里没有任何 benchmark:没有测试集名称、没有对比数字、没有样本量,对比对象只模糊写作“prior OpenAI models(此前的 OpenAI 模型)”。这与 的口径方向一致,但详略悬殊:OpenAI 称 Astra 是“世界上最智能且对齐程度最高的模型”、软件工程领域“迄今最好的模型”,并给出 Terminal-Bench 4.0 达到 57.9%、高于 GPT-5.6 Sol 的 37.3% 等分数,同样全部属于厂商自测。
OpenAI 分批开放之际,GitHub 渠道次日宣布 GA
GPT-6 Astra 于 9 月 3 日才由 OpenAI 揭晓。根据的记录,当天它仅以有限预览形式提供给受信任的合作伙伴,次日才向付费用户公开。OpenAI 发布页写明的计划是分阶段推送:先向一小部分组织开放,未来数天内覆盖全部 ChatGPT Plus、Pro、Business、Enterprise 用户,并接入 OpenAI API 与 AWS。
GitHub 走的是另一条产品渠道:9 月 4 日晚,Copilot 即宣布 GA,并在 changelog 中写明自己将渐进推送。Copilot 近期的模型上新相当密集,同一 changelog 页面的相关条目显示,9 月 1 日 Claude Fable 5.1 已在 Copilot 全面可用,9 月 3 日 Gemini 3.8 Flash 上线,Astra 是这一连串上新中的最新一项。
VS Code 官号当晚接力,首批试用者表态
公告发出约 20 分钟后,以引用推文的方式跟进:“GPT-6 Astra 现已与 GitHub Copilot 一起在 @code 全面可用!它专为长时程自主编码与 agent 任务打造,可以在工作过程中规划、验证并独立确认结果。今天就试试吧!”这条推文截至 9 月 5 日检索时有 357 次点赞。
开发者侧的反应随后出现。webpack 核心团队成员、微软软件工程师 Sean Larkin 在公告约 36 分钟后发推:“终于啊啊啊,走起。这个周末就开搞,虽然我讨厌在周末工作。”约 1 小时 40 分后,GitHub 开发者工具团队成员 Pierce Boggan 评价:“GPT-6 Astra + Copilot app is OP(太顶了)。”两人的身份以其各自 X 账号的自我介绍为准。
GitHub 主推文截至 9 月 5 日检索时获 349 次点赞、41 次转发、24 条回复、8 条引用推文,浏览量 55,625。
渐进推送之下,检验要等用户自己跑
眼下能核实的是:模型已进入模型选择器,默认面向四档套餐自动启用(管理员可关),按 OpenAI 官方列价计费,推送渐进进行。至于“更强、更少步骤”,支撑它的只有一段没有测试集、没有对比数字的内部测试描述。
对开发者来说,最直接的检验方式是等推送覆盖到自己的账号后,在模型选择器里选 GPT-6 Astra 跑一轮真正的长任务。由于按用量计费,这一轮验证的成本会按 OpenAI 官方列价直接出现在账单上;而“更少步骤”的说法是否成立,GitHub 的公告里还没有数据。