AI资讯 / 多模态

多模态 / 官方

把创意判断权交还给创作者

Runway News

Runway 近日发布 Agent 2.0,定位为把单一创意想法转化为完整作品的智能体。产品负责人 Aditi Poduval 与工程师 Kristian Muñiz 透露,Agent 的核心理念是围绕创作者的真实工作场景构建,强调在生成过程中保留人的判断权,而非让模型单方面输出结果。技术上,Agent 内置了不同模型的优劣知识与组合策略层,能根据任务自动选择最合适的模型;交互上采用视觉优先界面,用户可对图像直接进行挑选、拖回对话等操作。独立评测机构 Physion Labs 在 Arc 1.0 基准中将 Agent 2.0 排在六款视频智能体之首。该产品面向营销人员、影视创作者及需要端到端内容生产的团队。

Runway 近日正式推出 Agent 2.0,定位为把一个想法从雏形推进到成品的智能体。产品负责人 Aditi Poduval 表示,Agent 的出发点始终是 Runway 让叙事创作更普惠的使命——让没有专业制作团队或科班训练的人也能完成表达。它最初聚焦视频场景,如今已扩展到更广泛的叙事与创意工作,用户可以在同一界面中混合剪辑、音频与图像素材,直接产出完整成片,而非单一片段。

工程师 Kristian Muñiz 强调,生成媒体与判断什么是好作品是两件不同的事。Agent 的一大设计难点在于把 Runway 内部技术艺术家团队的审美与工艺判断嵌入系统,与底层模型能力叠加。Agent 会主动呈现多种方案与变体,让创作者始终掌握最终选择权。在外部验证方面,独立评估机构 Physion Labs 在 Arc 1.0 基准中将 Agent 2.0 排在六款 AI 视频智能体首位,尤其在电影感、连贯性与可信度方面获得高分。

在目标用户上,Poduval 表示 Agent 特别适合那些目标清晰但缺乏执行工具的人,其中营销人员是典型用例——从社媒内容、广告变体到完整活动企划,Agent 都能作为创意协作伙伴。同时,它也服务于从情绪、氛围或风格出发的发散型用户,以及需要把现有素材转译为视频或图像叙事的影视创作者,覆盖面远超营销场景。

Agent 的差异化来自 Runway 创意团队深度参与产品决策。创意负责人 Ian Sansavera 从原型设计到提示词工程全程介入,把工作流专家经验直接固化进产品。技术层面,Agent 编码了不同模型的优劣图谱:哪些擅长运动渲染、哪些更适合写实、哪些速度更快但精度有限,并在此之上叠加组合策略与工作流技能层,使系统真正理解自己在帮用户做什么样的内容,从而提出更具引导性的问题。

视觉优先的交互是 Agent 的另一关键设计。Muñiz 认为分镜是确保输出贴合脑海画面的重要步骤,因此 Agent 不会把生成的图像列表扔回聊天框,而是直接把可视化结果前置,让用户先看到、再反应。用户可以挑选、丢弃或把素材拖回对话,推动创意迭代。Poduval 补充说,许多用户最初并没有完整描述,而是先需要视觉素材来激发细化想法,因此 Agent 的迭代过程本质上是视觉化的,而非纯文本的。

Poduval 进一步指出,Agent 不只是生成媒体,更是端到端完成创意工作的入口。用户可以把表现数据、市场背景或创意简报等输入一起带入,让 Agent 基于这些信息提出新策略或简报,再据此生成实际素材,例如上传 PDF 广告表现数据后直接产出新方向。Runway 的建议是,无论是带着精细愿景还是模糊想法进入,Agent 都能通过持续对话帮用户逐步把创意推向更完整的形态。

要点

  • Agent 2.0 的核心理念是把创意判断权留在用户手中,系统通过呈现多种方案和变体来辅助而非替代决策。
  • ['Agent 内置不同 AI 模型的能力图谱与组合策略层,能根据任务自动选择最合适的模型组合,并理解任务所处的创作语境。', '独立评测机构 Physion Labs 在 Arc 1.0 基准中将 Agent 2.0 排在六款视频智能体首位,尤其在电影感与连贯性上表现突出。', 'Agent 采用视觉优先交互界面,生成结果直接前置展示,用户可通过挑选、拖回对话等方式进行视觉化迭代。', 'Agent 支持端到端创意工作流,可接入表现数据、市场背景或创意简报等输入,从策略层一路推进到成片产出。']
查看原始来源

原始标题:Inside Our Approach to Building Runway Agent

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。