产业 / 媒体
AI 视频生成更快更便宜
谷歌将旗下 Gemini Omni Flash 视频模型更新至1.1版本,带来多项实质性改进。在场景延伸能力上,新版本可分析最多10秒的已有素材(此前仅为最后1秒),从而生成视觉连贯性更强的延伸片段,每次可延伸10秒,最长累计延伸至40秒。开发者还可上传最多3秒的外部素材作为风格参考,将角色形象或运动规律迁移至新生成内容,并可通过设定起止帧来控制镜头运动路径。在成本方面,新增的360p草稿模式相比720p速度最高提升60%,费用仅为后者的三分之一,按秒计费价格为0.03美元。生成的视频支持上调至1080p乃至4K分辨率。该模型已通过 Google AI Studio 及开发者文档正式开放使用。
谷歌于2026年8月27日正式发布 Gemini Omni 1.1 Flash,这是其面向开发者的 AI 视频生成模型的最新迭代版本。此次升级的核心改进集中在场景延伸的连贯性上——新版本在生成延伸片段时,会分析前序视频中最多10秒的内容,而旧版本仅参考最后1秒的画面。这一变化意味着模型能够更好地理解场景的运动趋势、光线变化和视觉风格,从而输出更自然流畅的延伸结果。
在延伸时长方面,Omni 1.1 Flash 支持以10秒为单位逐步延伸视频,最长可累计延伸至40秒。开发者还可以上传最多3秒的外部参考素材,将其中的角色外观或动作模式迁移到新生成的视频中,实现跨片段的风格一致性。此外,通过设定起始帧与结束帧,开发者可以精确控制镜头在两个关键帧之间的运动轨迹,为创意制作提供更强的可控性。
成本与速度是此次更新的另一大亮点。新增的360p草稿模式相比720p标准模式速度最高提升60%,而费用仅为后者的三分之一。这一模式适合在正式渲染前进行快速预览和创意验证,有效降低了迭代成本。按秒计费的价格体系如下:360p为每秒0.03美元,720p为0.10美元,1080p为0.15美元,4K为0.30美元。
在分辨率支持上,Omni 1.1 Flash 生成的视频可进一步上调至1080p或4K,满足对画质有更高要求的应用场景。与谷歌旗下其他视频模型相比,Omni 1.1 Flash 在720p和4K价格上与 Veo 3.1 Fast 持平,但新增了360p这一更低成本的入门选项,整体定价策略更具灵活性,覆盖从快速原型到高清成片的完整工作流。
Gemini Omni 1.1 Flash 现已通过 Google AI Studio 向开发者开放,相关技术文档也已同步更新。此次升级延续了谷歌在 AI 视频生成领域持续加码的策略,在与 OpenAI Sora、Runway 等竞争对手的角力中,以更低的使用门槛和更灵活的功能组合争夺开发者生态的主导权。
要点
- 场景延伸分析窗口从1秒扩展至10秒,视频连贯性显著提升,最长可累计延伸40秒
- 新增360p草稿模式,速度提升最高60%,成本仅为720p的三分之一,每秒仅需0.03美元
- 支持上传3秒外部参考素材以迁移角色或动作风格,并可通过关键帧控制镜头运动
- 完整分辨率价格体系覆盖360p至4K,生成视频可上调至1080p或4K输出
- 模型已在 Google AI Studio 正式开放,面向开发者提供完整文档支持
原始标题:Google's Gemini Omni 1.1 Flash makes AI video generation cheaper and more flexible
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。