工程 / 工程
Claude Opus 5.5 正式登陆 AWS,推理效率更高、成本更低
Anthropic 旗下最新旗舰模型 Claude Opus 5.5 已正式在 Amazon Bedrock 及 AWS 上的 Claude Platform 上线,成为 Claude 5.5 系列的首款发布模型。与前代 Claude Opus 5 相比,Opus 5.5 在完成相同任务时消耗的 token 更少,叠加更低的每 token 定价和大幅降低的缓存读取费用,整体每次任务成本显著下降,使团队能够以更低预算运行更复杂的智能体工作流。模型在沟通透明度上也有明显提升,能够主动汇报任务进展、发现内容与待解问题,便于开发者追踪长时任务的执行状态。此外,Opus 5.5 首次引入与 Claude Fable 5.1 类似的安全分类器,覆盖生物学、网络安全和 AI 开发等高风险领域,对敏感请求的拒绝频率高于前代版本。目前该模型已在美国、欧洲、澳大利亚、日本等多个地区的推理配置文件中可用。
Claude Opus 5.5 是 Anthropic 迄今最强的 Opus 系列模型,专为智能体编码、知识型工作和长时任务设计。AWS 官方宣布,该模型现已在 Amazon Bedrock 和 AWS 上的 Claude Platform 正式上线,成为 Claude 5.5 模型家族的首款产品。对于已在 AWS 生态中构建 AI 应用的团队而言,这意味着无需迁移基础设施即可直接升级至最新一代模型能力。
在成本效率方面,Opus 5.5 相比 Opus 5 实现了显著优化。模型完成同等任务所需的 token 数量更少,Anthropic 同步下调了每 token 定价,并大幅降低了缓存读取费用。三重叠加之下,平均每次任务的实际花费低于前代,使企业能够在预算不变的前提下扩大智能体工作流的规模与复杂度。
Opus 5.5 在任务透明度上引入了重要改进。模型在执行过程中会主动输出已完成的操作、发现的信息以及尚待解决的问题,让开发者和业务用户能够清晰追踪长时任务的每个阶段。自适应思考机制默认开启,模型会根据任务复杂度自动分配推理深度,开发者可通过「effort」参数进行宏观调控,无需手动设置思考预算。
安全性方面,Opus 5.5 是首款内置安全分类器的 Opus 模型,覆盖生物学、网络安全和 AI 开发三个高风险领域,与 Claude Fable 5.1 的防护机制对齐。这意味着涉及上述领域的敏感请求将比前代版本更频繁地被拒绝。对于在受监管行业或高合规要求场景中部署模型的团队,这一变化需要在集成阶段提前评估和测试。
在实际应用场景中,Opus 5.5 对软件开发和知识型工作的适配性尤为突出。在软件开发场景下,更清晰的过程说明使代码审查和调试更加高效;在知识工作场景下,处理长文档和报告时所需的人工纠错次数明显减少。开发者可通过 Amazon Bedrock 控制台的 Playground 直接测试,也可通过 Boto3 SDK、Bedrock Converse API 或 Anthropic SDK 以编程方式调用,模型 ID 为 global.anthropic.claude-opus-5-5。
在可用性方面,Claude Opus 5.5 目前已通过美国、欧盟、澳大利亚、日本及全球推理配置文件在 bedrock-runtime 上提供服务,同时在 us-east-1 和 ap-southeast-4 区域通过 bedrock-mantle 运行。北美地区用户还可通过 AWS 上的 Claude Platform 访问。开发者可参考 GitHub 上的入门 Notebook 快速上手,并借助 Amazon CloudWatch 和 AWS Cost Explorer 监控使用量与成本。
要点
- Claude Opus 5.5 在 token 效率、定价和缓存读取三个维度同步优化,平均每次任务成本低于前代 Opus 5,适合大规模智能体工作流部署。
- 模型新增任务过程透明度机制,自动汇报执行状态与待解问题,并通过自适应思考替代手动思考预算,降低开发者调优负担。
- 首次引入覆盖生物学、网络安全和 AI 开发领域的安全分类器,敏感请求拒绝率提升,高合规场景用户需提前测试兼容性。
- 已在美国、欧盟、澳大利亚、日本等多区域上线,支持 Boto3、Converse API 和 Anthropic SDK 三种调用方式,接入门槛较低。
原始标题:Claude Opus 5.5 is now available on AWS
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。