模型 / 官方
更强大的自主代理能力与高性价比
Anthropic 于 2026 年 6 月 30 日发布 Claude Sonnet 5,这是迄今为止最具代理能力的 Sonnet 系列模型。它能够制定计划、使用浏览器和终端等工具,并以更低的成本实现接近 Opus 4.8 的性能。相比前代 Sonnet 4.6,Sonnet 5 在推理、工具使用、编码和知识工作等关键代理能力上取得显著进步。安全评估显示,其不良行为率更低,在代理场景中更安全。该模型即日起在所有计划中可用,并推出限时优惠价格。早期合作伙伴反馈一致认为,Sonnet 5 能自主完成复杂任务,检查自身输出,并以极具吸引力的价格提供高效执行。
Anthropic 正式推出 Claude Sonnet 5,这是其 Sonnet 系列的最新模型,专为增强自主代理能力而设计。该模型能够制定计划、使用浏览器和终端等工具,并以接近 Opus 4.8 的性能水平自主运行,但成本显著降低。对于许多开发者而言,代理式 AI 时代始于 Sonnet 级模型,而 Sonnet 5 进一步缩小了与 Opus 系列的差距,在推理、工具使用、编码和知识工作等关键领域较前代 Sonnet 4.6 实现大幅提升。
在多项评估中,Sonnet 5 的表现均优于 Sonnet 4.6,并在某些任务上匹配 Opus 4.8 的能力水平。安全评估表明,Sonnet 5 的不良行为率整体低于 Sonnet 4.6,在代理场景中更安全。此外,其执行网络安全任务的能力远低于当前 Opus 模型,进一步增强了安全性。该模型即日起在所有计划中可用,包括免费版、Pro 版、Max 版、Team 版和 Enterprise 版,并集成于 Claude Code 和 Claude 平台。
Sonnet 5 推出限时优惠定价:截至 2026 年 8 月 31 日,输入令牌每百万个 2 美元,输出令牌每百万个 10 美元;之后恢复为输入每百万个 3 美元,输出每百万个 15 美元。相比之下,Opus 4.8 的定价为输入每百万个 5 美元,输出每百万个 25 美元。开发者可通过 Claude API 使用 claude-sonnet-5 模型。成本-性能曲线显示,Sonnet 5 在中高努力水平下提供显著改善的成本效率,部分任务的高努力表现可媲美 Opus 4.8。
早期合作伙伴的反馈高度一致:Sonnet 5 比前代更具代理能力。测试者描述,它能完成复杂任务,而之前的 Sonnet 模型往往中途停止;它会主动检查自身输出,无需明确指示;并以极具吸引力的价格完成所有代理工作。例如,有用户表示,Sonnet 5 能端到端完成更新 Salesforce 账户层级并发送发布公告的两部分任务,而此前模型常在半路卡住。另一用户指出,Sonnet 5 在未提示的情况下,自行编写复现测试、实施修复并验证,全程一次完成。
在具体应用中,Sonnet 5 在遗留代码处理、法律研究、数据分析等领域表现突出。有用户称,它在处理竞态条件、隐藏测试等棘手代码时,能追踪到根本原因并交付持久修复,而非仅修补症状。在 ClickHouse 代理中,它通过更紧凑的推理步骤,显著加快用户获取答案的速度。在保险工作流中,它始终快速采取正确行动。对于管理高容量、复杂工作负载的企业团队,Sonnet 5 在关键性能上实现真正进步,兼具速度和成本优势。
总体而言,Claude Sonnet 5 代表了代理式 AI 模型的重要一步。它在多项复杂任务上超越当前前沿,同时提供快速响应和低成本。对于大规模运行的企业,这意味着一项切实的运营胜利。开发者可通过 Claude 平台和 API 立即体验 Sonnet 5 的强大能力,并利用限时优惠价格进行部署。
要点
- Claude Sonnet 5 是 Anthropic 最新发布的 Sonnet 系列模型,具备更强的自主代理能力,性能接近 Opus 4.8,但价格更低。
- 该模型在推理、工具使用、编码和知识工作等关键领域较前代 Sonnet 4.6 显著提升,安全评估显示不良行为率更低。
- Sonnet 5 即日起在所有计划中可用,并推出限时优惠定价,截至 2026 年 8 月 31 日。
- 早期合作伙伴反馈一致,Sonnet 5 能自主完成复杂任务,主动检查输出,并以高性价比提供高效执行。
- 该模型在遗留代码处理、法律研究、数据分析等实际应用中表现突出,适合企业级高容量工作负载。