产业 / 媒体
架构革新、性能全面超越 V4 Pro,API 定价同步下调
深度求索于 2026 年 9 月 10 日正式发布 DeepSeek V4.1 Flash,这是其全新模型结构系列中参数规模最小的成员,总参数量达 552B,采用混合专家(MoE)架构与全新的 Causal-Encoder-Decoder 非对称结构,输入激活仅 8B、输出激活 16B,在同尺寸模型中成本优势显著。新模型原生支持多模态视觉理解,经过更大规模的强化学习后训练,在多项基准测试中超越了包括 DeepSeek V4 Pro 在内的旗舰模型。与上一代相比,V4.1 Flash 对 HBM 的需求降至 1/4,对 SSD 的需求降至 1/8,KV Cache 相较初代模型压缩至 1/437,大幅降低了 Agent 类任务的运行成本。官方同步下调 API 定价,并维持峰谷计费机制,新价格自 9 月 10 日 12:00 起生效。腾讯旗下 WorkBuddy、CodeBuddy 及 OpenCode 已作为官方合作伙伴完成全量接入。
深度求索此次发布的 DeepSeek V4.1 Flash 是其全新模型结构系列的首款落地产品,定位为该系列中参数规模最小的版本。模型总参数量为 552B,采用混合专家(MoE)架构,并引入了全新的 Causal-Encoder-Decoder 非对称结构。这一设计使输入激活参数仅为 8B、输出激活参数为 16B,在保持强大能力的同时,将推理成本控制在同尺寸已知模型中的较低水平。官方表示,新模型结构的设计目标是能力上限更高、推理速度更快、吞吐量更大,并具备向更大参数规模扩展的潜力。
在训练层面,V4.1 Flash 采用了全新的预训练方式,并经历了更大规模的强化学习后训练流程。这使其在 Agentic Benchmark 等多项主流评测中,成功超越了包括 DeepSeek V4 Pro 在内的一众旗舰模型。官方经多方测试确认,V4.1 Flash 在性能、费用、速度及总用时等各项核心指标上均已全面超越 V4 Pro,因此决定有序下线后者。北京时间 2026 年 9 月 14 日 12:00 起,用户访问 deepseek-v4-pro 的请求将全部路由至 V4.1 Flash,并按 V4.1 Flash 单价计费,直至未来 V4.1 Pro 正式上线。
内存与存储效率的大幅提升是 V4.1 Flash 的另一项核心亮点。与上一代模型相比,新模型对高带宽内存(HBM)的需求降至原来的 1/4,对 SSD 的需求降至原来的 1/8。从更长的历史维度来看,DeepSeek 的 KV Cache 相较初代模型已压缩至 1/437。在 Agent 使用场景中,缓存命中费用往往在总成本中占据较高比例,KV Cache 的大幅压缩直接降低了此类任务的运营成本,对于需要长上下文处理的企业级应用尤为关键。
V4.1 Flash 已同步上线 DeepSeek API,原生支持多模态视觉理解,开发者只需将模型名称更改为 deepseek-flash 即可调用最新版本。旧版本模型 V4 Flash 与 V4 Flash Vision Exp 现已正式下线,出于兼容性考虑,原有模型名称 deepseek-v4-flash 和 deepseek-v4-flash-vision-exp 将暂时路由至 V4.1 Flash。腾讯旗下的 WorkBuddy、CodeBuddy 以及 OpenCode 作为官方合作伙伴,目前已完成对 V4.1 Flash 的全量接入。
得益于架构层面的创新所带来的成本优势,深度求索同步下调了 V4.1 Flash 的 API 定价,新价格自 2026 年 9 月 10 日 12:00 起正式生效。定价机制上,V4.1 Flash 继续沿用峰谷计费模式,闲时价格为高峰时段的一半,以鼓励用户根据实际业务需求灵活安排任务时间,从而实现更合理的资源调配。目前,模型权重已在 Hugging Face 开源,技术报告同步公开,供研究者与开发者参考。
要点
- DeepSeek V4.1 Flash 采用 552B MoE 架构与全新非对称 Causal-Encoder-Decoder 结构,输入激活仅 8B,在同尺寸模型中具备显著成本优势。
- KV Cache 相较初代模型压缩至 1/437,HBM 需求降至上一代的 1/4,大幅降低 Agent 类长上下文任务的运行成本。
- 基准测试中 V4.1 Flash 全面超越 V4 Pro,官方将于 9 月 14 日起将 V4 Pro 请求路由至 V4.1 Flash 并按新单价计费。
- 模型原生支持多模态视觉理解,已上线 DeepSeek API,腾讯 WorkBuddy、CodeBuddy 及 OpenCode 完成全量接入。
- API 定价同步下调,继续采用峰谷计费机制,闲时价格为高峰时段的一半,新价格自 9 月 10 日起生效。
原始标题:DeepSeek V4.1 Flash 模型正式发布:全面超越 V4 Pro、原生多模态视觉理解,API 定价下调
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。