AI资讯 / 产业

产业 / 媒体

单任务成本比 GPT-5.6 Luna 低约 60%

IT之家

深度求索(DeepSeek)于 7 月 31 日正式上线 DeepSeek-V4-Flash 正式版 API 公测,多家权威 AI 基准测试平台随即同步发布评测结果。在 Artificial Analysis 智能指数(AII)榜单中,DeepSeek V4 Flash 0731 获得 50 分,仅比 GPT-5.6 Luna 的 51 分低 1 分,却在成本上实现了显著优势——即便 OpenAI 当日将 GPT-5.6 Luna 价格下调 80%,DeepSeek 自有 API 的单任务成本仍低约 60%。这一差距的核心在于 DeepSeek 提供高达 98% 的缓存命中折扣,远超行业普遍的 90% 水平。在 Arena.ai 的前端代码竞技场(Frontend Code Arena)中,DeepSeek-V4-Flash-High 以 1586 分位列总榜第 7、开放类别第 3,较预览版提升 154 分,展现出强劲的前端工程能力与极高的性价比。

7 月 31 日,深度求索通过 API 文档发布日志,正式宣布 DeepSeek-V4-Flash 正式版 API 上线公测。次日,Artificial Analysis 与 Arena.ai 两大国际权威基准测试平台同步更新了针对该模型的评测数据,为开发者和企业用户提供了较为全面的性能与成本参考。

在 Artificial Analysis 智能指数(AII)评测中,DeepSeek V4 Flash 0731 获得 50 分。这一成绩比 2026 年 4 月发布的 DeepSeek V4 Flash 旧版高出 10 分,也比 DeepSeek V4 Pro 高出 6 分,显示出正式版在模型能力上的明显迭代进步。与此同时,该分数仅比 OpenAI GPT-5.6 Luna 的 51 分低 1 分,两者在综合智能水平上几乎处于同一量级。

成本层面的差距则更为突出。即便 OpenAI 在同日将 GPT-5.6 Luna 的价格大幅下调 80%,DeepSeek V4 Flash 0731 在其自有 API 上的单任务成本仍比 GPT-5.6 Luna 低约 60%。这一优势的关键来源是 DeepSeek 为自有 API 提供的约 98% 缓存命中折扣,远超业内大多数厂商通常提供的 90% 折扣水平,使得高频调用场景下的实际费用大幅压缩。

在 Arena.ai 旗下的前端代码竞技场(Frontend Code Arena)中,DeepSeek-V4-Flash-High 以 1586 分的成绩刷新了榜单格局,总排名位列第 7,在开放类别中更跻身第 3 位。细分领域方面,该模型在消费产品类排名第 4,在基于参考的设计、数据与分析、游戏类均排名第 6,在品牌与营销类排名第 7,展现出较为均衡的前端工程综合能力。

与此前版本相比,DeepSeek-V4-Flash-High 的提升幅度相当显著——相较于 DeepSeek-V4-Flash-High-Preview 提升了 154 分,相较于 DeepSeek-V4-Pro-Preview 也提升了 121 分。在定价方面,该模型每百万 Token 的输入价格约为 0.14 美元(约合 0.95 元人民币),输出价格约为 0.28 美元(约合 1.9 元人民币),在同类高性能模型中具备突出的性价比优势,吸引了大量开发者在 X 平台分享与 GPT-5.6 Luna、Kimi K3 等模型的实测对比视频。

要点

  • DeepSeek V4 Flash 0731 在 Artificial Analysis 智能指数中获得 50 分,仅比 GPT-5.6 Luna 低 1 分,综合能力接近顶尖水平
  • 凭借高达 98% 的缓存命中折扣,DeepSeek 自有 API 单任务成本比 GPT-5.6 Luna 低约 60%,即便后者已大幅降价
  • 在 Arena.ai 前端代码竞技场中,DeepSeek-V4-Flash-High 以 1586 分位列总榜第 7、开放类别第 3,较预览版大幅提升 154 分
  • 每百万 Token 输入价格约 0.14 美元,在同类高性能模型中性价比突出,适合高频调用的企业和开发者场景
查看原始来源

原始标题:DeepSeek-V4-Flash 正式版跑分报告:单任务成本比 GPT-5.6 Luna 低约 60%

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。