工程 / 工程
OpenAI GPT-5.6 三款模型正式登陆 Amazon Bedrock,覆盖推理、生产与高并发场景
OpenAI GPT-5.6 系列的三款模型——Sol、Terra 和 Luna——已在 Amazon Bedrock 上正式开放。Sol 定位旗舰推理模型,适合自主编程、安全研究与深度多步推理;Terra 在性能与成本之间取得平衡,适用于日常生产工作负载;Luna 则针对高并发、低延迟场景优化,适合分类、摘要与路由等任务。三款模型均支持文本与图像输入、272K Token 上下文窗口,并通过统一的 bedrock-mantle 端点调用 OpenAI Responses API,无需额外部署模型基础设施。所有调用均在用户的 AWS IAM 策略和 VPC 内运行,并记录于 CloudTrail,支持区域内推理以满足数据驻留要求。定价与 OpenAI 官方保持一致,用量可计入现有 AWS 承诺消费,开发者可通过调整推理力度参数在成本与效果之间灵活权衡。
GPT-5.6 系列采用 OpenAI 全新命名体系:数字代表模型代际,Sol、Terra、Luna 则标识三个持久能力层级,各层级可独立迭代演进。Sol 的模型 ID 为 openai.gpt-5.6-sol,目前在美东(弗吉尼亚北部)和美东(俄亥俄)两个区域可用;Terra 和 Luna 的 ID 分别为 openai.gpt-5.6-terra 和 openai.gpt-5.6-luna,额外支持美西(俄勒冈)区域。三款模型均支持 none、low、medium、high、xhigh 和 max 六档推理力度,切换模型时无需修改 API 集成代码。
开发者通过 bedrock-mantle 端点访问 GPT-5.6,基础 URL 格式为 https://bedrock-mantle.{region}.api.aws,Responses API 路径为 /openai/v1/responses。该端点兼容 OpenAI 官方 Python 和 TypeScript SDK。将现有 OpenAI SDK 应用迁移至 Amazon Bedrock,只需替换 base_url 为 bedrock-mantle 地址、更新模型 ID,并使用 Amazon Bedrock API 密钥或 AWS 凭证完成身份验证,改动量极小。
身份验证支持两种方式:一是使用 BedrockOpenAI 客户端配合 token provider,在每次请求前自动从 AWS 凭证生成并刷新短期密钥,适合生产环境;二是将短期密钥写入环境变量 AWS_BEARER_TOKEN_BEDROCK 后传入标准 OpenAI 客户端,但该密钥最长 12 小时后过期,生产场景建议配合 AWS Secrets Manager 使用。IAM 托管策略 AmazonBedrockMantleInferenceAccess 可快速授予所需权限,包括 bedrock-mantle:CreateInference 和 bedrock-mantle:CallWithBearerToken。
推理力度参数是控制成本与效果的核心旋钮。对于复杂多步任务,将 reasoning effort 设为 high 或 max 可让模型在生成答案前投入更多推理 Token,显著提升结果质量,但会增加延迟和费用;对于分类、路由等简单任务,设为 low 或 none 则可大幅降低成本。三款模型共享相同的参数接口,团队可根据每个工作负载的复杂度独立调整,实现精细化成本管控。
在安全与数据处理方面,所有模型调用均在用户的 VPC 内执行,受 IAM 策略约束,并记录于 AWS CloudTrail,支持区域内推理以满足数据驻留合规要求。用户的提示词和补全内容不会用于训练任何模型,也不会与模型提供方共享,除非用户主动选择加入。被分类器标记的流量会在 AWS 侧保留最多 30 天用于自动化离线滥用检测,保留配置可通过数据保留模式自行管理。
GPT-5.6 还支持工具调用与 OpenAI Codex 编程智能体集成,开发者可定义客户端工具并让模型在完成请求过程中主动调用。提示词缓存功能可进一步降低重复内容的推理成本,并通过 Token 用量统计衡量缓存命中率。对于计划大规模部署的团队,建议提前评估配额需求并制定扩容方案,以确保高并发场景下的服务稳定性。
要点
- GPT-5.6 Sol、Terra、Luna 三款模型已在 Amazon Bedrock 正式可用,通过统一的 bedrock-mantle 端点和 OpenAI Responses API 调用,迁移现有应用改动极小
- 三款模型覆盖从深度推理到高并发低延迟的全场景需求,六档推理力度参数支持在成本与效果之间精细权衡
- 所有调用在用户 VPC 和 IAM 策略内运行,支持区域内推理,提示词与补全内容不用于模型训练,也不默认共享给 OpenAI
- 定价与 OpenAI 官方一致,用量计入现有 AWS 承诺消费,提示词缓存可进一步降低重复工作负载的成本
- 支持工具调用与 OpenAI Codex 编程智能体集成,适合构建自主编程、长链推理等复杂智能体应用
原始标题:Get started with OpenAI GPT-5.6 Sol, Terra, and Luna on Amazon Bedrock
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。