AI资讯 / 产业

产业 / 媒体

开源模型与闭源差距反弹至 3.3%,DeepSeek V4 Flash 全球月调用居首

IT之家

Mozilla 发布 2026 年《开源 AI 现状报告》。基于 Chatbot Arena 数据,开放权重模型与闭源模型的平均能力差距为 3.3%,相较 2024 年 8 月的 0.5% 有所扩大,主要体现在推理、长上下文检索与智能体任务上,而在编码、指令执行和通用知识方面基本持平。OpenRouter 平台 2026 年 6 月数据显示,API 月调用 Token 量前五名全部为开源模型,DeepSeek V4 Flash 以 18.4T Tokens 登顶,小米 Mimo-V2.5 与腾讯 Hy3 Preview 分列二、三位。价格方面,GPT-4 级模型每百万 Token 价格从 2022 年末的 20 美元降至 2025 年 12 月的 0.40 美元。调查显示 79% 开发者已采用开源模型,但仅 51% 能成功部署至生产环境。

Mozilla 于 7 月 14 日发布 2026 年《开源 AI 现状报告》,基于 Chatbot Arena 平台 2026 年 3 月数据,指出开放权重模型与闭源模型的平均能力差距为 3.3%。报告追溯了过去 24 个月的演变:2024 年 1 月差距高达 8.04%,同年 8 月缩小至 0.5%,并在 2025 年 2 月 DeepSeek-R1 发布后一度与美国顶级模型基本持平,但到 2026 年 3 月差距再次小幅扩大。

报告强调,3.3% 仅为平均数值,实际能力差异并不显著。在编码、指令执行和通用知识等维度上,开放模型与闭源模型已基本持平或非常接近,差距主要集中在推理、长上下文检索以及智能体任务等高复杂度场景。这意味着开源阵营在多数通用任务上已具备替代闭源模型的能力。

价格曲线同样呈现开源模型的竞争优势。GPT-4 级模型每百万 Token 的调用成本从 2022 年末的 20 美元骤降至 2025 年 12 月的 0.40 美元,36 个月内缩水至五十分之一,降幅远超互联网时代带宽和个人电脑计算的历史曲线,反映出底层算力与推理优化的快速进步。

在全球实际使用层面,开源模型已占据明显优势。OpenRouter 2026 年 6 月数据显示,API 月调用 Token 量前五名全部来自开源阵营。DeepSeek V4 Flash 以 18.4T Tokens 登顶全球月用量榜首,小米 Mimo-V2.5 以 14.9T Tokens 排名第二,腾讯 Hy3 Preview 以 14.8T Tokens 位列第三,中国厂商在该榜单中表现突出。

然而,采用率与部署成功率之间存在显著落差。Mozilla 与 SlashData 联合调查显示,79% 的开发者已在项目中采用开放权重模型,与闭源模型采用率持平;但在生产环境部署环节,仅 51% 的开源模型团队成功上线,而闭源模型团队的成功率高达 63%。

报告指出,阻碍开源模型落地的关键并非模型本身的能力,而是性能优化、系统集成和长期运维等工程层面的挑战。这意味着开源阵营下一阶段的核心议题,正从模型能力竞赛转向工程化与生态成熟度的比拼。

要点

  • 开源与闭源模型的能力差距在 2026 年 3 月小幅回升至 3.3%,但主要集中在推理、长上下文检索与智能体任务上,通用任务上已基本持平
  • DeepSeek V4 Flash、小米 Mimo-V2.5、腾讯 Hy3 Preview 包揽 OpenRouter 全球 API 月调用 Token 量前三,开源模型在调用量上全面领先
  • GPT-4 级模型每百万 Token 价格在 36 个月内由 20 美元降至 0.40 美元,降幅达 50 倍
  • 79% 开发者已采用开源模型,但仅 51% 能成功部署至生产环境,落地瓶颈来自性能、集成与运维等工程问题
  • 开源阵营竞争焦点正从模型能力转向工程化与生态成熟度
查看原始来源

原始标题:Mozilla 发布 2026 开源 AI 报告:DeepSeek V4 Flash 全球月用量 18.4T Tokens 登顶

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。