AI资讯 / 工程

工程 / 官方

Claude Sonnet 4 上下文窗口扩展至 100 万 Token

Claude Blog

Anthropic 宣布 Claude Sonnet 4 在 Anthropic API 上正式支持最高 100 万 Token 的上下文窗口,较此前提升 5 倍。这一能力现已在 Claude 开发者平台进入公开测试阶段,同时也在 Amazon Bedrock 和 Google Cloud Vertex AI 上线。开发者可借此在单次请求中处理超过 75,000 行代码的完整代码库,或同时分析数十篇研究论文。为应对更高的计算需求,超过 20 万 Token 的提示词将采用差异化定价:输入价格从每百万 Token 3 美元升至 6 美元,输出价格从 15 美元升至 22.50 美元。结合提示词缓存与批量处理功能,用户可进一步降低延迟与成本。目前该功能面向 Tier 4 及自定义速率限制的客户开放,更广泛的可用性将在未来数周内逐步推出。

Anthropic 于 2025 年 8 月 12 日宣布,Claude Sonnet 4 的上下文窗口正式扩展至 100 万 Token,是原有容量的 5 倍。这一升级意味着开发者可以在单次请求中输入超过 75,000 行代码的完整代码库,或同时处理数十篇研究论文,大幅拓展了模型在数据密集型任务中的应用边界。该功能目前已在 Anthropic API、Amazon Bedrock 以及 Google Cloud Vertex AI 上提供公开测试版本。

在具体应用场景方面,超长上下文带来了三类核心能力提升。首先是大规模代码分析:开发者可将源文件、测试代码与文档一并载入,让 Claude 理解整体项目架构、识别跨文件依赖关系,并基于完整系统设计提出改进建议。其次是文档合成:可同时处理法律合同、研究论文或技术规范等大量文档,在保持完整上下文的前提下分析数百份文件之间的关联。

第三类核心场景是上下文感知智能体。开发者可以构建能够在数百次工具调用和多步骤工作流中保持连贯性的智能体,将完整的 API 文档、工具定义和交互历史一并纳入上下文,无需担心信息丢失。这对于需要长时间运行、跨多个系统协作的自动化工程任务尤为关键。

在定价方面,Anthropic 针对超长上下文采用了分级收费策略。20 万 Token 以内的提示词维持原有价格,输入为每百万 Token 3 美元,输出为 15 美元;超过 20 万 Token 后,输入价格调整为每百万 Token 6 美元,输出为 22.50 美元。用户可结合提示词缓存功能降低延迟与成本,若使用批量处理模式还可额外节省 50% 的费用。

多家企业已率先将这一能力应用于实际产品。浏览器端开发平台 Bolt.new 的 CEO Eric Simons 表示,100 万 Token 上下文窗口让开发者能够在保持高准确率的前提下处理规模更大的项目。伦敦 AI 公司 iGent AI 的 CEO Sean Ward 则指出,这一突破使其软件工程智能体 Maestro 得以支持真正意义上的生产级工程任务,包括在真实代码库上持续多天的工作会话,开创了智能体软件工程的新范式。

目前,100 万 Token 长上下文功能面向 Tier 4 及拥有自定义速率限制的客户开放,更广泛的访问权限将在未来数周内逐步推出。Anthropic 表示,也在探索将长上下文能力引入其他 Claude 产品线的可能性。开发者可通过官方文档和定价页面了解详细信息并开始接入。

要点

  • Claude Sonnet 4 上下文窗口扩展至 100 万 Token,较此前提升 5 倍,可在单次请求中处理超过 75,000 行代码的完整代码库
  • 超过 20 万 Token 的提示词采用差异化定价,输入价格翻倍至每百万 Token 6 美元,结合批量处理可额外节省 50% 成本
  • 三大核心应用场景为大规模代码分析、跨文档合成以及支持数百次工具调用的上下文感知智能体
  • 功能已在 Anthropic API、Amazon Bedrock 和 Google Cloud Vertex AI 上线,目前面向 Tier 4 及自定义速率限制客户开放
  • Bolt.new 和 iGent AI 等企业已将该能力用于生产级代码生成与自主软件工程任务
查看原始来源

原始标题:Claude Sonnet 4 now supports 1M tokens of context | Claude by Anthropic

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。