AWS Bedrock 在印度上线 GPT-5.6 跨区域推理
亚马逊云科技在印度孟买与海得拉巴区域推出 OpenAI GPT-5.6 系列模型,支持境内跨区域推理以满足数据本地化要求…
亚马逊云科技(AWS)近日宣布,在 Amazon Bedrock 平台面向印度市场推出 OpenAI GPT-5.6 系列模型,并支持印度境内跨区域推理(cross-Region inference)。该服务首批覆盖孟买(ap-south-1)与海得拉巴(ap-south-2)两个区域,主要面向金融、医疗、公共部门等存在数据本地化处理需求的客户。
模型与能力
此次在 Bedrock 上线的 GPT-5.6 包含 Terra 和 Luna 两个变体,均支持 100 万 token 上下文窗口,可同时接收文本与图像输入并输出文本。借助这一上下文长度,单次请求即可处理长文档、大型代码库以及图文混合任务,且整个推理过程不会离开印度境内。
在数据安全方面,Bedrock 采用零数据留存(ZDR)策略,默认不存储模型输入与输出。不过需要注意,包括 GPT-5.6 在内的部分模型,被自动化滥用检测分类器标记的内容可能会被保留,用于离线滥用检测。
印度境内跨区域推理
跨区域推理本质上是一种容量调度机制。当源区域算力不足时,Bedrock 会自动把请求路由到同一地理范围内的其他区域,从而提升吞吐量、缓解高峰压力。印度境内跨区域推理仅在 ap-south-1 与 ap-south-2 之间调度请求,确保数据始终留在印度。
用户通过推理配置文件(inference profile)调用模型,目前提供两个配置文件:
in.openai.gpt-5.6-terra:对应 GPT-5.6 Terra 变体in.openai.gpt-5.6-luna:对应 GPT-5.6 Luna 变体
计费和配额仍按源区域账户统计,Amazon CloudWatch 和 AWS CloudTrail 的日志也只在源区域记录,便于统一监控。对于新应用,AWS 建议使用 bedrock-runtime 端点,该端点同时支持 Bedrock 原生 InvokeModel/Converse API、OpenAI 兼容 API 以及 Anthropic Messages API,并可使用 Guardrails、智能提示路由和跨区域推理等 Bedrock 特性。
全球跨区域推理
除印度境内配置文件外,Bedrock 还提供以 global. 为前缀的全球配置文件,可将请求路由至 AWS 全球各商业区域以获取最大容量。全球配置文件同样支持 GPT-5.6 系列(包括 Sol、Terra 和 Luna)。但若业务存在数据本地化要求,仍建议使用 in. 前缀的境内配置文件,以保证推理不离开印度。
控制台与 API 接入
用户可在 Bedrock 控制台的 Playground 中直接试用 GPT-5.6:在已上线区域登录控制台,依次进入「测试」→「Playground」,搜索并选择 IN OpenAI GPT-5.6 Terra,即可输入提示词并运行生成。
在 API 层面,GPT-5.6 在 Bedrock 上原生支持 OpenAI Responses API 格式。已有 OpenAI SDK 集成的应用,可将客户端指向印度区域任一 Bedrock 端点,并把推理配置文件 ID 作为模型参数传入。认证方面,既可使用标准 AWS 凭据,也可使用 Bedrock API Key——后者与 OpenAI SDK 的集成更为直接。
