Agent / 分析
性能媲美 Fable 5.1,价格直降 40%
2026 年 9 月 22 日,Anthropic 发布 Claude Opus 5.5,定位为 Claude 5.5 系列的开篇之作。官方宣称该模型在绝大多数任务上达到 Claude Fable 5.1 的能力水准,同时运行成本比 Opus 5 低 40%、速度提升约 30%。Token 定价从每百万输入/输出 5 美元/25 美元下调至 4 美元/20 美元。然而第三方分析指出,Opus 5.5 在高强度任务中 Token 消耗量显著增加,在最大努力模式下每任务实际成本与 Opus 5 相近。模型已成为 Claude Code 和 Claude 应用的默认选项,并在写作表达、智能体编码、计算机操控等方面获得合作伙伴的独立评测认可。Anthropic 同步发布了系统卡,首次报告了多达 100 个并行智能体的多智能体扩展实验结果。OpenAI 在约一小时后跟进发布 GPT-6 Sol 与 Luna,但市场关注度明显被 Opus 5.5 压制。
Anthropic 于北京时间 9 月 23 日凌晨正式推出 Claude Opus 5.5,将其定义为全新 Claude 5.5 系列的首款模型。官方核心卖点是:在绝大多数任务上达到旗舰级 Claude Fable 5.1 的智能水准,同时运行成本比上一代 Opus 5 降低 40%、推理速度提升约 30%。该模型即刻成为 Claude Code、Claude 应用及 Cowork 协作功能的默认模型,并同步上线 Claude Platform API 和面向 Slack 的 Claude Tag 集成。
在定价层面,Anthropic 将 Opus 5.5 的 Token 单价从每百万输入/输出 5 美元/25 美元下调至 4 美元/20 美元,降幅约 20%。然而第三方机构 Artificial Analysis 的拆解数据显示,在最大努力模式下,Opus 5.5 每项智能指数任务的实际成本约为 5.98 美元,与 Opus 5 的 5.86 美元相差无几。原因在于该模型在高难度任务中 Token 消耗量大幅上升,若仅考虑用量增加因素,每任务成本将上涨约 80%,最终依靠价格下调和更低廉的缓存读取费用才将成本拉回接近原位。官方所称的「40% 更便宜」主要适用于默认的中等努力模式。
写作质量的改进是本次发布中被重点强调的亮点之一。Anthropic 表示,Opus 5.5 能够将最重要的信息置于回复前端,并严格遵循用户设定的写作规则,使长会话更易于跟进。AINews 编辑团队在实际对比 Opus 5.5 与 GPT-6 Sol 的输出后,认为差距「天壤之别」,并宣布即刻将 AINews 的生成模型切换至 Opus 5.5。订阅层面,Pro、Max 和 Team 用户的 5 小时会话限额提升 20%,并新增可自由支取的速率限制重置额度。
在第三方评测中,Opus 5.5 表现亮眼。Vals 指数排名跃升至第一,且是首个在其协议下超越 LM Training 公开参考基准的模型;Cognition 的 FrontierCode 1.1 测试中以 65.3% 的成绩夺得第一;Cursor 的 CursorBench 测试中以 57.8% 成为最强模型,每任务成本比 Opus 5 低 40%。在 Proximal 的 FrontierSWE 测试中,Opus 5.5 以 62.3% 位列第二,仅次于 GPT-6 Astra 的 65.5%,但领先于 Fable 5.1 的 56.3%。Anthropic 自身的对比表格显示,Opus 5.5 在 CursorBench、KWBench 和 OSWorld 等基准上均超越 GPT-6 Astra。
安全与多智能体扩展是本次系统卡的两大重点。Opus 5.5 是首款配备 Fable 5.1 级别安全防护的 Opus 模型,涵盖网络安全、生物安全和前沿 LLM 开发等高风险领域,被标记的请求将自动回退至其他模型。Anthropic 同步公布了多达 100 个并行智能体的多智能体扩展实验,成为业内首家在系统卡中正式报告此规模多智能体协作数据的实验室。后续 Sonnet 5.5 和 Haiku 5.5 将在「未来数周内」陆续推出,此前关于 Haiku 系列停产的传言也随之被官方否认。
就市场格局而言,OpenAI 在 Opus 5.5 发布约一小时后推出 GPT-6 Sol 与 Luna,定价较 GPT-5.6 下调 50%,但发布热度明显被压制。Opus 5.5 的发布推文在短时间内获得超过 1720 万次浏览、8 万余次点赞。有开发者注意到,Opus 5.5 的模型体量可能小于 Opus 5,推测 Anthropic 在后训练阶段取得了重大突破,但这一点尚未获得官方证实。整体来看,本轮发布标志着头部模型厂商在效率竞争上进入新阶段——更小的模型、更低的价格、更强的能力正在成为新的行业基准。
要点
- Claude Opus 5.5 在默认中等努力模式下比 Opus 5 便宜约 40%、速度快约 30%,但在最大努力模式下因 Token 消耗增加,实际每任务成本与 Opus 5 基本持平。
- 写作质量和指令遵循是本次升级的核心改进方向,AINews 等实际用户已将默认模型切换至 Opus 5.5。
- Anthropic 首次在系统卡中公开报告 100 个并行智能体的多智能体扩展实验,标志着大规模智能体协作研究进入新阶段。
- 第三方评测显示 Opus 5.5 在多项编码和知识工作基准上领先或接近 GPT-6 Astra,Sonnet 5.5 和 Haiku 5.5 将在数周内跟进发布。
- OpenAI 同日发布 GPT-6 Sol 与 Luna 并大幅降价,但市场关注度被 Opus 5.5 显著压制,头部模型厂商的效率竞争正在加速。
原始标题:[AINews] Claude Opus 5.5, the new default model for AINews — and everybody cuts prices 40-50%
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。