工程 / 官方
Claude Opus 4.6 与 Sonnet 4.6 正式开放 100 万 Token 上下文窗口
Anthropic 正式宣布,Claude Opus 4.6 与 Sonnet 4.6 的 100 万 Token 上下文窗口现已在 Claude Platform 上全面开放,不再需要测试版请求头,也不附加任何长上下文溢价。Opus 4.6 的定价为每百万 Token 输入 5 美元、输出 25 美元,Sonnet 4.6 为 3 美元与 15 美元,无论请求长度是 9K 还是 900K Token,均按相同单价计费。每次请求可携带的图片或 PDF 页面数量从原来的 100 张提升至 600 张。Claude Code 的 Max、Team 和 Enterprise 用户在使用 Opus 4.6 时将自动启用 100 万 Token 上下文,大幅减少上下文压缩次数,保留更完整的对话历史。该功能同步在 Amazon Bedrock、Google Cloud Vertex AI 和 Microsoft Foundry 上提供。
Anthropic 于 2026 年 3 月 13 日宣布,Claude Opus 4.6 与 Sonnet 4.6 的 100 万 Token 上下文窗口正式进入全面可用阶段。此前该功能处于测试期,需要在请求头中添加特定标识才能启用。现在,超过 20 万 Token 的请求将自动生效,已使用测试版请求头的代码无需任何修改,旧有标识将被系统自动忽略。这一改变降低了开发者的接入门槛,使长上下文能力可以直接融入现有工作流。
在定价方面,Anthropic 明确表示不设长上下文溢价。Opus 4.6 的标准价格为每百万输入 Token 5 美元、输出 25 美元;Sonnet 4.6 则为 3 美元与 15 美元。无论单次请求消耗 9K 还是 900K Token,均按相同单价计费,账户的标准吞吐量限制也在整个上下文窗口范围内统一适用。这种定价结构使企业在规划大规模长文档处理任务时,成本预测更加清晰可控。
媒体输入能力同步升级,每次请求可携带的图片或 PDF 页面数量从 100 张提升至 600 张,增幅达 6 倍。这对需要同时处理大量合同文件、科研论文或多图表报告的场景尤为关键。在模型性能方面,Opus 4.6 在 MRCR v2 基准测试中以 78.3% 的得分位居前沿模型首位,证明其在百万 Token 范围内具备可靠的细节召回与跨段落推理能力。
多家企业已在实际业务中验证了这一能力的价值。法律科技公司 Eve 表示,100 万 Token 上下文让其代理系统能够跨越 400 页庭审记录进行交叉比对,显著提升了答案质量。代码审查平台 Cognition 的工程师指出,完整差异文件可一次性输入模型,避免了分块处理导致的跨文件依赖丢失问题。物理研究机构则利用扩展后的媒体限制,在单次推理中综合数百篇论文、数学证明与仿真代码,加速了基础与应用物理研究进程。
对于 Claude Code 用户而言,100 万 Token 上下文的意义在于减少强制压缩的频率。此前,当用户加载大型 PDF、数据集或图片时,系统往往需要提前压缩上下文,导致关键细节丢失。据用户反馈,上下文压缩事件减少了约 15%,代理可以在数小时内持续运行而不遗忘早期读取的内容。该功能目前已在 Claude Platform 原生接口以及 Amazon Bedrock、Google Cloud Vertex AI、Microsoft Foundry 上同步提供。
要点
- Claude Opus 4.6 与 Sonnet 4.6 的 100 万 Token 上下文窗口正式全面开放,无需测试版请求头,超过 20 万 Token 的请求自动生效
- 全窗口统一标准定价,不附加长上下文溢价,Opus 4.6 为 5/25 美元每百万 Token,Sonnet 4.6 为 3/15 美元
- 每次请求可携带的图片或 PDF 页面数量从 100 张提升至 600 张,增幅 6 倍
- Opus 4.6 在 MRCR v2 基准测试中以 78.3% 得分领跑前沿模型,具备跨百万 Token 的可靠推理能力
- Claude Code 的 Max、Team 和 Enterprise 用户将自动启用 100 万 Token 上下文,上下文压缩事件减少约 15%
原始标题:1M context is now generally available for Opus 4.6 and Sonnet 4.6 | Claude by Anthropic
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。