AI资讯 / 产业

产业 / 媒体

性能追平 Fable 5.1,成本降低四成,告别「Claudish」文风

The Decoder

Anthropic 正式发布 Claude Opus 5.5,这是其全新模型系列的首款旗舰产品。官方表示,Opus 5.5 在大多数任务上可与 Claude Fable 5.1 持平,同时比 Opus 5 的运营成本低约 40%,输出速度提升逾 30%。定价方面,输入 token 从每百万 5 美元降至 4 美元,输出 token 从 25 美元降至 20 美元,缓存读取成本更大幅削减 60%。在编程、知识工作、多学科推理等多项基准测试中,Opus 5.5 均领先于 OpenAI 的 GPT-6 Astra,且每项任务的成本仅为后者的五分之一至四成。此外,Anthropic 承诺新模型将减少此前被用户批评为「Claudish」的程式化、冗长写作风格,使输出更自然、更易读。Opus 5.5 现已在 AWS、Google Cloud 及 Microsoft Azure 等主流云平台上线,Claude Sonnet 5.5 与 Haiku 5.5 预计数周内跟进发布。

Anthropic 将 Opus 5.5 定位为新一代模型系列的开篇之作。根据官方基准数据,该模型在代理编程(FrontierCode v1.1 得分 54.4%)、多学科推理(Humanity's Last Exam 67.7%)以及计算机操控(OSWorld 2.0 81.8%)等核心维度上均超越前代 Opus 5 及 Fable 5.1,并在大多数指标上压过 OpenAI 的 GPT-6 Astra。独立评测平台 Artificial Analysis 也证实,Opus 5.5 在其智能指数中以 58 分创下历史新高,领先此前最高纪录数个百分点。

成本是此次发布的核心卖点之一。Anthropic 将输入 token 价格从每百万 5 美元下调至 4 美元,输出 token 从 25 美元降至 20 美元,缓存读取成本则骤降 60%,至每百万 0.20 美元。综合 token 价格与实际用量,官方估算总运营成本较 Opus 5 下降约 40%。这一降价策略被外界解读为对 OpenAI 及中国低价 AI 模型竞争压力的直接回应。在编程任务上,Opus 5.5 声称以约五分之一的成本实现与 GPT-6 Astra 相当甚至更优的表现。

写作质量的改进同样是此次更新的重点。此前,Claude 系列模型因输出风格程式化、措辞冗长而被用户戏称为「Claudish」,在金融、法律及软件开发等专业领域尤为突出。Anthropic 表示,Opus 5.5 经过专项优化,能够将最重要的信息置于首位,减少行话,并更严格地遵循用户的写作指令。早期测试者反馈,新模型的输出更清晰、更易于理解,适合长时间协作工作场景。

安全机制方面,Opus 5.5 是首款在网络安全、生物学及前沿大模型开发领域达到 Fable 5.1 同等防护标准的 Opus 模型。当安全分类器触发时,相关请求将被透明地路由至其他模型处理——网络安全任务转至 Opus 4.8,生物学或前沿模型开发请求则转至 Opus 5。此外,Anthropic 还引入「Preserved Thinking」反蒸馏机制,防止 API 用户通过篡改上下文提取模型推理过程,并新增水印功能以符合欧盟 AI 法案要求。

在更宏观的行业背景下,Anthropic 借此次发布呼吁提高 AI 安全标准,尤其针对具备自动化 AI 研究能力的高端模型。公司计划更严格地筛查强化学习训练环境,并推进对齐奖励机制与安全监控手段的改进。外部机构 Frontier Design 与 METR 在发布前对 Opus 5.5 进行了独立测试。Claude Sonnet 5.5 与 Haiku 5.5 预计将在未来数周内陆续推出,延续同等性能与效率提升路径。

要点

  • Opus 5.5 在大多数基准测试中与 Fable 5.1 持平甚至超越,同时将运营成本压低约 40%,输出速度提升逾 30%。
  • 输入 token 降价 20%,缓存读取成本削减 60%,Anthropic 以价格优势正面应对 OpenAI 及中国低价模型的竞争。
  • 新模型专项优化写作风格,承诺减少程式化的「Claudish」表达,提升在金融、法律、软件开发等专业场景的实用性。
  • 安全机制全面升级,引入反蒸馏「Preserved Thinking」功能及欧盟 AI 法案合规水印,敏感请求将被自动路由至专属模型。
  • 独立平台 Artificial Analysis 确认 Opus 5.5 以 58 分创下其智能指数历史新高,在 Humanity's Last Exam 等关键评测中刷新纪录。
查看原始来源

原始标题:Claude Opus 5.5 matches Fable 5.1 performance at lower cost and promises less "Claudish" writing

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。