产业 / 媒体
性能媲美旗舰级模型,运行成本较上代降低 40%
Anthropic 正式推出 Claude Opus 5.5,这是 Claude 5.5 系列家族的首款模型。官方宣称其在大多数任务上的表现可媲美 Claude Fable 5.1,而典型工作负载下的运行成本比上一代 Opus 5 低 40%,输出速度则提升逾 30%。在性能层面,早期测试者反映 Opus 5.5 在复杂编码任务中表现突出,一名测试人员在不到一天内完成了原本需要数周才能处理完的 68 万行代码迁移工作。安全方面,Opus 5.5 在 Anthropic 自动化行为审计中取得了迄今所有模型中的最高分,对提示注入攻击的抵抗力也强于前代。定价方面,输入与输出 Token 价格分别为每百万 4 美元和 20 美元,较 Opus 5 下调 20%,缓存命中价格更大幅降低 60%。Claude Sonnet 5.5 与 Haiku 5.5 预计将在未来数周内陆续发布。
Anthropic 于近日正式发布 Claude Opus 5.5,将其定位为 Claude 5.5 家族的旗舰开篇之作。官方表示,该模型在大多数工作场景下的表现可与 Claude Fable 5.1 相当,同时在计算效率上实现了显著突破——典型工作负载下的运行成本比上一代 Opus 5 降低 40%,输出速度提升超过 30%,为企业级用户提供了更具性价比的选择。
在性能表现上,Opus 5.5 的提升尤为亮眼。一名早期测试者在不到一天内借助该模型完成了 68 万行代码的迁移工作,而这一任务按常规估算需要数周时间。在网页应用性能优化测试中,Opus 5.5 在 40 次尝试中成功将每个页面的加载时间缩短了 39 次,而 Opus 5 仅完成了少量改进且改变了应用原有行为。此外,在多模型游戏构建对比测试中,Opus 5.5 凭借更精致的画面与细节获得了最高评分。
安全性是 Opus 5.5 的另一大亮点。该模型在 Anthropic 的自动化行为审计套件中取得了所有已发布模型中的最高分,该套件涵盖数千个模拟场景,测试范围已扩展至更长任务、不可能完成的任务以及基于真实事件的场景。与近期其他模型相比,Opus 5.5 采取难以逆转行动或越界操作的概率更低,对提示注入攻击的抵抗能力也明显强于前代。
由于 Opus 5.5 在生物学和网络安全领域的能力与 Claude Mythos 5.1 相当,Anthropic 在部署时采取了类似 Claude Fable 5.1 的防护措施。经过审核的机构即日起可申请生命科学验证项目,使用 Opus 5.5 开展生物学研究;未来数周内,认证网络安全从业者也将获得相应访问权限,用于专业安全工作。
在定价与套餐调整方面,Opus 5.5 的输入 Token 价格为每百万 4 美元,输出 Token 为每百万 20 美元,均较 Opus 5 下调 20%;缓存命中价格降至每百万 0.20 美元,降幅高达 60%。除价格调整外,Anthropic 还放宽了 Pro、Max、Team 等企业套餐的使用时间限制,并为订阅用户新增速率限制重置功能,客户可随时保存并灵活使用额度。
在沟通能力方面,Opus 5.5 的表达方式比前代模型更为自然流畅。早期测试者普遍反映其输出文字更清晰易懂,能够将最重要的信息优先呈现,在长时间协作中表现出更强的工作伙伴特质。Anthropic 同时宣布,Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来数周内相继推出,同样将在性能、效率与安全性方面带来多项改进。
要点
- Claude Opus 5.5 在典型工作负载下的运行成本比上代 Opus 5 低 40%,输出速度提升逾 30%,Token 定价同步下调 20%,缓存命中价格降低 60%。
- 在编码能力测试中,Opus 5.5 帮助测试者在不到一天内完成了 68 万行代码迁移,网页性能优化任务成功率达 97.5%(40 次中成功 39 次)。
- Opus 5.5 在 Anthropic 自动化行为审计中取得所有已发布模型最高分,对提示注入攻击的抵抗力强于前代,安全边界更为稳固。
- 由于在生物学和网络安全领域能力较强,Anthropic 对 Opus 5.5 实施了严格的访问验证机制,仅向经审核的机构和认证从业者开放相关功能。
- Claude Sonnet 5.5 与 Haiku 5.5 预计数周内发布,Claude 5.5 家族将进一步完善,覆盖更广泛的使用场景与预算需求。
原始标题:Anthropic 发布 Claude Opus 5.5 模型:性能媲美 Fable 5.1,运行成本比 Opus 5 低 40%
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。