工程 / 工程
澳大利亚团队现可通过 Amazon Bedrock 跨区域推理访问 OpenAI 最新模型
亚马逊云科技宣布,澳大利亚团队现可通过 Amazon Bedrock 的全球跨区域推理功能,从亚太(悉尼)和亚太(墨尔本)两个 AWS 区域访问 OpenAI GPT-5.6 系列模型,包括 Sol、Terra 和 Luna。应用程序只需调用本地区域的 Amazon Bedrock Runtime 端点,系统将自动将请求路由至受支持的商业 AWS 区域进行处理,无需开发者手动管理目标区域的路由逻辑。三款模型均支持文本与图像输入,最大上下文窗口达 100 万 token,可通过 OpenAI Responses API、Chat Completions API 以及 Amazon Bedrock Converse API 三种方式调用。此次更新还引入了提示缓存优化推理成本、基于 OpenID Connect 的 Codex 身份验证,以及通过 Amazon CloudWatch 进行用量监控等实用功能,为澳大利亚本地企业构建 AI 应用提供了更完整的工程支撑。
Amazon Bedrock 现已在澳大利亚的亚太(悉尼,ap-southeast-2)和亚太(墨尔本,ap-southeast-4)两个区域正式支持 OpenAI GPT-5.6 全球推理配置文件。开发者无需更改应用架构,只需将请求发送至本地 Bedrock Runtime 端点,平台即可自动将流量路由至具备处理能力的商业 AWS 区域,从而获得更大的容量池,同时规避了手动管理多区域路由的复杂性。
GPT-5.6 系列包含三款定位各异的模型:Sol 专为高强度推理、代码生成和智能体工作负载设计;Terra 在性能与成本之间取得平衡,适合日常生产环境;Luna 则以低延迟、低成本为核心优势,面向高并发和对响应速度敏感的应用场景。三款模型均支持文本与图像输入,并提供高达 100 万 token 的超长上下文窗口,可满足复杂文档处理和多轮对话等需求。
在调用方式上,开发者可根据现有技术栈灵活选择。对于已使用 OpenAI SDK 的团队,只需将 base_url 指向 Amazon Bedrock Runtime 的区域端点,即可通过 Responses API 或 Chat Completions API 无缝切换。对于通过 AWS SDK 调用的场景,Converse API 则借助 boto3 的标准凭证链完成身份验证,无需额外配置静态密钥。此外,aws-bedrock-token-generator 工具可从当前 AWS 凭证动态生成短期 API 密钥,进一步提升安全性。
提示缓存是此次更新的重要工程特性之一。通过缓存重复出现的提示前缀,开发者可以显著降低高频调用场景下的推理成本,尤其适合系统提示较长或上下文固定的应用。与此同时,Codex 的 OpenID Connect 集成为企业级身份验证提供了标准化方案,可与现有的身份提供商体系对接,简化权限管理流程。
在可观测性方面,Amazon CloudWatch 与 Coding Agent Insights 的集成使团队能够实时监控模型调用量、延迟分布和错误率等关键指标。AWS 建议开发者在正式部署前通过 AWS CLI 或 Amazon Bedrock 控制台验证全球推理配置文件的激活状态,并确认组织的服务控制策略(SCP)已允许相关推理配置文件在所选源区域运行,以避免权限问题导致的调用失败。
要点
- 澳大利亚团队现可从悉尼和墨尔本区域直接访问 OpenAI GPT-5.6 Sol、Terra、Luna 三款模型,无需自行管理跨区域路由。
- 三种 API 调用路径(Responses API、Chat Completions API、Converse API)可满足不同技术栈的集成需求,迁移成本低。
- 提示缓存功能可有效降低高频调用场景的推理成本,适合上下文固定或系统提示较长的应用。
- OIDC 身份验证与 CloudWatch 监控的引入,为企业级生产部署提供了安全合规和可观测性保障。
- 部署前需确认 IAM 权限与组织 SCP 策略已允许相关全球推理配置文件,并建议定期检查配置文件成员资格变更。
原始标题:Accessing OpenAI models on Amazon Bedrock from Australia with global cross-Region inference
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。