AWS于9月8日宣布,OpenAI的GPT-6 Astra已在Amazon Bedrock正式可用。这并非新的基础模型发布,而是为该模型新增了一条由AWS托管的调用路径。开发者可通过Bedrock支持的API调用,也可在ChatGPT Work和Codex中配置使用该入口。
AWS模型卡显示,该模型的上下文窗口为1,050,000个token,最大输出长度为128,000个token,支持文本和图像输入、文本输出。在Bedrock Runtime中,可使用Responses、Chat Completions与Converse接口,不能使用Invoke接口。
模型标识为`openai.gpt-6-astra`。Bedrock Mantle仅在美国俄勒冈区域提供该模型;Bedrock Runtime提供美国地理跨区域和全球跨区域的推理标识。模型卡还列明标准层级按上下文档位定价,Priority和Flex层级暂不支持该模型。
AWS表示,推理数据不用于训练。其服务说明称,如自动滥用检测触发分类器标记,相关流量最多保留30天;零数据保留需通过AWS账户团队申请。这些内容属于托管服务的运行与数据处理说明,并不等同于对模型能力或安全效果的实测结论。
托管接入带来的部署选择
对已在AWS账户、权限体系和审计链路内运行应用的团队而言,Bedrock入口提供了另一种接入GPT-6 Astra的方式。若业务需要处理较长文本或图文输入,可结合模型卡披露的上下文、输出长度和接口范围规划调用;实际成本仍取决于上下文档位、输入输出规模及具体服务设置。区域路径也会影响上线安排:Mantle的可用区域有限,跨区域推理则需要结合自身的数据治理与部署要求核对。因而,模型能力之外,接口适配、区域选择和数据保留规则同样是生产环境集成时需要明确的条件。
| 涉及行业 | 行业影响分析 | 简要理由 |
|---|---|---|
| 应用软件 | 中性 | 新增托管调用路径和跨区域推理标识,为AWS环境内的模型接入增加了选择;长上下文、图文输入和多种接口可供集成,但接口适配及服务层级限制仍需逐项评估。 |
| 互联网服务与基础设施 | 中性 | 相关调用可纳入AWS托管环境,但实际使用规模仍取决于客户需求和区域可用性。 |
新闻热点内容来源于媒体公开报道。文章分析仅代表个人观点,不构成投资建议。
