AREX Feed Article
GPT-6 Astra 在 Amazon Bedrock 正式可用:最高 100 万输入 token,可经 Bedrock API 或 ChatGPT Work、Codex 调用
AWS 在 9 月 14 日的每周汇总里,把「OpenAI GPT-6 Astra 现已在 Amazon Bedrock 正式可用」放在了头条:模型可以直接经受支持的 Amazon Bedrock API 调用,也可以在 ChatGPT Work 和 Codex 中配置为使用部署在 Bedrock 上的同一个模型。AWS 的表述是上下文窗口最高支持 100 万输入 token,指向大型代码库、长合同和成规模文档集这类任务()。
GA 的原始公告发布于 2026 年 9 月 8 日,比这份周报早 6 天。AWS 的 What's New 页面把发布日标为 2026 年 9 月 8 日;同日发布的 AWS 机器学习博客给出了完整产品细节,其页面时间戳为 2026-09-08T14:06:58-08:00(、)。Bedrock 模型卡同样把上线日期记为 2026 年 9 月 8 日,状态 Active,EOL 不早于 2027 年 9 月 8 日()。OpenAI 在自己的发布页上写明,该模型先向有限机构开放,随后几天向全部 ChatGPT Plus、Pro、Business、Enterprise 用户,以及 OpenAI API、Microsoft Azure、AWS Bedrock 提供()。上述日期与范围均出自 AWS 与 OpenAI 自己的公告。
两条调用路径:Bedrock API,或在 ChatGPT Work、Codex 里指向 Bedrock
第一条路径是把模型集成进自己的应用。AWS 列出的场景是:跑处理多步流程的自主 agent、做成规模文档分析合成工具,以及做需要在冲突输入之间做判断的客户侧应用。
第二条路径不改代码,改工具配置。ChatGPT Work 被描述为把复杂业务任务变成成品交付物的生产力 agent,可以跨应用和文件收集信息、使用网页,产出电子表格、幻灯片、文档和网站,通过 Mac 与 Windows 的 ChatGPT 桌面应用提供。Codex 是软件工程 agent,入口包括 ChatGPT 桌面应用、CLI、VS Code、JetBrains IDE 和 Xcode;面向 AWS 开发时,Agent Toolkit for AWS 用一条终端命令把 Codex 连接到 AWS 文档、API 和服务能力。以上细节均来自 AWS 的发布博客。
与本次发布同时,OpenAI 为 ChatGPT Work 引入新的企业插件,把 Astra 的浏览器使用能力延伸到商业智能工具、Workday、Navan 和 Avalara,覆盖数据分析、运营与财务任务。AWS 博客特别说明,这些插件通过用户已有账号、在管理员设定的权限内工作,因此不会给 Astra 额外授权。
上下文 1,050,000 token,输入超过 272,000 token 后价格翻倍
模型卡给出的规格是:上下文窗口 1,050,000 token,最大输出 128,000 token,知识截止日期 2026 年 4 月 30 日。AWS 公告里说的「最高 100 万输入 token」与模型卡的数字是同一件事的两种口径。
定价按输入长度分两档,分界线是 272,000 token。短上下文(输入 272,000 token 及以下)用 Standard 层级:In-Region 与地域级跨区域(Geo CRIS)输入每百万 token 11 美元、输出 55 美元;全球级跨区域(Global CRIS)输入 10 美元、输出 50 美元。长上下文(输入超过 272,000 token)价格翻倍:In-Region 与 Geo 输入 22 美元、输出 82.50 美元,全球级 20 美元与 75 美元。模型卡注明,商业区域的 In-Region 价格已在 OpenAI 价格之上计入 10% 的附加费,用户无需另行叠加;Priority 与 Flex 两个服务层级对该模型不可用。
缓存价格同样分档。短上下文下,30 分钟缓存写入每百万 token 为 12.50 美元(全球级跨区域)或 13.75 美元(In-Region 与 Geo),缓存读取为 1.00 与 1.10 美元;长上下文档的缓存写入为 25.00 与 27.50 美元,缓存读取为 2.00 与 2.20 美元。AWS 博客称该模型同时支持隐式与显式 prompt caching,显式缓存可以设置 cache breakpoints 指定哪些上下文进入缓存,重复使用同一上下文能减少重复处理、成本和延迟。
bedrock-runtime 不支持 In-Region,bedrock-mantle 只在俄勒冈
两个端点使用同一个模型 ID openai.gpt-6-astra,但可用范围差别很大。
在 bedrock-runtime 上,模型卡列出 17 个区域,包括美国 4 个区域、加拿大、法兰克福、斯德哥尔摩、爱尔兰、伦敦、巴黎、东京、首尔、大阪、孟买、新加坡、悉尼和圣保罗,但没有一个区域支持 In-Region 调用:文档要求把跨区域推理配置文件名写进请求,即 us.openai.gpt-6-astra 或 global.openai.gpt-6-astra。地域级跨区域只在美国和加拿大的 5 个区域可用(us-east-1、us-east-2、us-west-1、us-west-2、ca-central-1),欧洲与亚太区域只列出全球级跨区域这一种方式。
在 bedrock-mantle 上,情况相反:只有俄勒冈(us-west-2)一个区域、只有 In-Region 一种方式,端点地址是 https://bedrock-mantle.us-west-2.api.aws/openai/v1,路径用 /openai/v1 而不是 /v1。API 支持也不一样,模型卡在 bedrock-runtime 下列出 Responses、Chat Completions 和 Converse,在 bedrock-mantle 下只列出 Responses 与 Chat Completions。此外,bedrock-mantle 在 Responses API 下支持隐式与显式 prompt caching,但不支持 application inference profiles;bedrock-runtime 支持调用日志、流式响应、护栏(仅 Converse API)等能力,不支持服务端工具使用(server-side tool use)、结构化输出和 token 计数。
AWS 称推理数据不用于训练,分类器标记的流量保留最多 30 天
AWS 博客写明:使用 GPT-6 Astra 的推理数据不会用于模型训练,也不需要选择把数据共享给 OpenAI。用于自动滥用检测时,被分类器标记的流量会由 AWS 保留最多 30 天并以程序化方式处理;需要完全不留存的组织,可以通过 AWS 客户团队申请零数据保留。
访问控制的细节是:零操作员访问在芯片层强制执行,连 AWS 运维人员也无法访问推理过程中的 prompt 与补全;数据在传输和静态时加密;访问由 IAM 策略管理,每次调用都记录在 CloudTrail;可以通过 AWS PrivateLink 走 VPC 端点,也可以在组织层面建立数据边界策略,防止数据跨账号、跨网络边界外泄。这些都是 AWS 在其发布博客中的说明。
OpenAI 称 Astra 达到网络安全 Critical 分级,防护可暂停越界活动
AWS 博客称,OpenAI 通过 Preparedness Framework 对 GPT-6 Astra 做了评估,这是首个在网络安全能力上达到 Critical 分级的 OpenAI 模型;在这一分级下,自动防护会实时监控误用,并可暂停或停止越出既定边界的活动,这些防护在 Amazon Bedrock 的服务边界内运行。OpenAI 自己的发布页也写明 Astra 达到其框架下的网络安全 Critical 阈值,并表示当前版本会拒绝为漏洞编写概念验证利用代码这类更高级的网络安全任务,计划在未来几周通过 Daybreak 放宽部分限制以支持防御性工作流。
OpenAI 同时说明,额外的安全检查有时会拖慢、暂停或中断正常工作,包括防御性网络安全任务;任务在 ChatGPT 或 Codex 中被暂停时,用户可能被要求先复核再继续,而在 API 中任务会直接停止。
第三方实测:两个端点都能调通,全球级跨区域与 OpenAI 直连同价
DevelopersIO 的作者 suzuki.ryo 在 9 月 9 日发布了一篇上手记录()。他用 aws bedrock list-foundation-models 拿到的返回显示:模型 ID 为 openai.gpt-6-astra,输入模态是文本与图像,输出模态是文本,支持流式响应,inferenceTypesSupported 只有 INFERENCE_PROFILE,startOfLifeTime 为 2026-09-08T17:00:00+00:00。
调用层面,他在 us-east-1、us-west-2、ap-northeast-1 三个区域用 Converse 调用 global.openai.gpt-6-astra 都得到了一致结果;走 bedrock-runtime 的 /openai/v1/responses 与 /openai/v1/chat/completions 两条 OpenAI 兼容路径都返回 HTTP 200。他在文中提示,在 bedrock-runtime 上执行 Responses API 调用需要针对推理配置文件与默认项目的 bedrock:InvokeModel 权限。他记录的一个具体限制与模型卡一致:同一个模型 ID 在 bedrock-mantle 上只在 us-west-2 有效,换到 us-east-1 会返回 404 和「The model 'openai.gpt-6-astra' does not exist」。
价格对照方面,他比较了短上下文(272,000 token 以内)不启用缓存时的每百万 token 单价:Bedrock 全球级跨区域为输入 10 美元、输出 50 美元,与 OpenAI 直连相同;In-Region 与地域级跨区域都比这个数字高 10%,与模型卡中关于附加费的说明一致。可用范围仍带着地域条件:模型卡在 bedrock-runtime 上没有任何区域支持 In-Region 调用,按文档说明全球级跨区域会把请求路由到世界任何地方,因此需要数据驻留的欧洲、日本等团队对应的只有 bedrock-mantle 在俄勒冈(us-west-2)的 In-Region 这一条路。