产业 / 媒体
MiniMax H3 开源权重发布,成为首个登顶AI视频排行榜的开放模型
中国AI公司MiniMax正式开放其H3视频生成模型的权重,这是首次有开源模型登上主流AI视频能力排行榜榜首。根据Artificial Analysis的评测,H3在视频编辑类别中排名第一,文本生成视频排名第二,图像生成视频排名第三。H3是一个拥有330亿参数的多模态模型,能够同时处理文本、图像、视频和音频输入,生成时长4至15秒、带有立体声音效的视频片段。单次提示最多可包含9张参考图像、3段视频片段和3段音频片段。不过,2K分辨率模块及负责将提示词转化为结构化中间格式的H3-Context-IR组件并未开放,本地部署最高仅支持768p分辨率。此外,商业使用仅限于年收入低于2000万美元的企业。同日,字节跳动也发布了闭源的Seedance 2.5,可生成带内置音频的30秒视频。
MiniMax于2026年8月3日正式开放H3视频生成模型的权重,这是AI视频领域的一个重要里程碑——开源模型首次在主流评测排行榜上超越闭源竞品。根据Artificial Analysis的最新评测,H3在视频编辑类别中位居第一,文本生成视频排名第二,图像生成视频排名第三,综合表现在开源模型中无出其右。
H3是一个拥有330亿参数的多模态大模型,能够统一处理文本、图像、视频和音频四类输入信号,并生成时长4至15秒、附带立体声音效的视频片段。根据官方模型卡的说明,用户在单次提示中最多可以同时引用9张参考图像、3段视频片段和3段音频片段,为创作者提供了相当丰富的多模态控制能力。
尽管权重已经开放,H3仍有两个关键组件处于闭源状态:负责生成2K高分辨率视频的模块,以及将提示词和参考素材转化为结构化中间格式的H3-Context-IR。这意味着在ComfyUI等本地部署环境中,视频输出分辨率上限为768p,用户还需要参照MiniMax发布的提示词指南自行处理上下文准备工作。
开放权重支持用户基于自定义素材、角色或特定视觉风格进行微调,这为独立创作者和中小型团队提供了较大的定制空间。然而,商业授权方面存在明显门槛:仅允许年收入低于2000万美元的企业将H3用于商业目的,规模较大的公司若有商业需求则需另行洽谈授权。
就在H3开源权重发布的同一天,字节跳动也推出了闭源视频生成模型Seedance 2.5。与H3相比,Seedance 2.5能够生成时长达30秒的视频,并内置音频生成能力,两款产品在功能定位上形成了直接竞争。这一时间节点的巧合,折射出中国AI公司在视频生成赛道上日趋激烈的角力态势。
MiniMax H3的开源发布,标志着AI视频生成领域的竞争格局正在发生结构性变化。此前,顶级视频生成能力几乎被Sora、Runway等闭源商业产品所垄断,而H3的出现证明开源路线同样能够在技术性能上与闭源模型一较高下。随着更多中国AI公司选择开放模型权重,全球开发者社区有望在此基础上加速推动视频生成技术的普及与创新。
要点
- MiniMax H3是首个在主流AI视频评测排行榜上夺得第一的开源模型,在Artificial Analysis视频编辑类别中排名第一。
- H3拥有330亿参数,支持文本、图像、视频、音频多模态输入,可生成4至15秒带立体声的视频片段。
- 2K分辨率模块和H3-Context-IR组件未开放,本地部署最高仅支持768p分辨率,用户需自行处理上下文准备。
- 商业授权仅限年收入低于2000万美元的企业,大型商业机构使用受到限制。
- 字节跳动同日发布闭源Seedance 2.5,可生成30秒带内置音频的视频,两者在视频生成赛道上形成直接竞争。
原始标题:China's MiniMax H3 is the first open model to top an AI video ranking
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。