AI资讯 / 产业

产业 / 媒体

谷歌发布 Gemini Omni 1.1 Flash 视频生成模型,支持最高 4K 分辨率输出

IT之家

谷歌于当地时间 8 月 27 日正式发布 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高可输出 4K 分辨率的高质量视频内容。新模型在功能层面带来多项升级:支持基于已有视频从结尾处无缝续写,单条视频最长可累计扩展至 40 秒;支持指定起始帧与结束帧以实现平滑转场;新增 360p 快速预览模式,生成速度较标准 720p 提升最高 60%,成本仅为原来的三分之一,适合快速原型验证与分镜迭代;同时支持引入最长 3 秒的参考视频片段,以维持角色与场景的一致性。定价方面,360p 每秒 0.03 美元,720p 每秒 0.1 美元,1080p 每秒 0.15 美元,4K 每秒 0.3 美元,覆盖从原型开发到专业成片的多种使用场景。

谷歌于 8 月 27 日发布 Gemini Omni 1.1 Flash 视频生成模型,将 AI 视频创作能力推向新的分辨率上限。该模型可直接输出 1080p 或 4K 规格的最终成片,画质细腻、细节完善,面向有专业交付需求的内容创作者与开发者群体。

在创作流程层面,新模型引入场景扩展功能,用户可在已有视频的结尾处以每次 10 秒的步长逐步续写内容,单条视频累计时长最长可达 40 秒。这一设计让创作者无需重新生成整段视频,即可灵活延伸叙事内容,显著降低迭代成本。

首尾帧指定功能同样值得关注。用户只需提供镜头的起始帧与结束帧,模型便可自动生成中间过渡画面,实现平滑自然的运镜与转场效果。这对需要精确控制镜头语言的影视制作和广告创意场景尤为实用。

为满足快速验证需求,Gemini Omni 1.1 Flash 新增 360p 低分辨率预览模式。与标准 720p 相比,该模式生成速度最高提升 60%,成本仅为原来的三分之一,适合用于快速原型验证、分镜脚本迭代以及高速批量渲染等场景,有效缩短从创意到可视化的周期。

视频参考功能方面,用户在构建视频场景时可引入最长 3 秒的参考视频片段,模型将依据参考内容精准维持画面的上下文背景与角色一致性,有助于在多镜头或系列内容创作中保持视觉风格的统一。

定价结构覆盖多个使用层级:360p 每秒 0.03 美元(约合 0.2 元人民币),720p 每秒 0.1 美元(约合 0.67 元人民币),1080p 每秒 0.15 美元(约合 1 元人民币),4K 每秒 0.3 美元(约合 2 元人民币)。这一梯度定价策略兼顾了个人开发者的低成本探索需求与专业团队的高质量交付需求。

要点

  • Gemini Omni 1.1 Flash 支持最高 4K 分辨率视频输出,可直接生成专业级最终成片。
  • 场景扩展功能允许用户以 10 秒为步长续写视频,单条最长可达 40 秒,降低重复生成成本。
  • 360p 预览模式生成速度较标准版提升最高 60%,成本降至三分之一,适合快速原型与分镜迭代。
  • 支持引入最长 3 秒参考视频片段,帮助维持多镜头创作中的角色与场景一致性。
  • 梯度定价从每秒 0.03 美元起,覆盖从低成本验证到高质量专业交付的全流程需求。
查看原始来源

原始标题:谷歌推出 Gemini Omni 1.1 Flash 视频生成 AI 模型,最高 4K 分辨率

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。