做AI视频的人大多有过这样的经历:生成一段满意的素材之后,真正的麻烦才开始。抠像要换工具,深度信息要另找软件算,动态范围不足还得回炉重做。9月21日,Runway给Workflows补上五项后期能力,明确指向把分散的环节收进同一条流程。
按官方列出的顺序,这次新增的能力是合成、透明通道、高动态范围、深度图与带颜色信息的深度数据。合成负责把不同图层或元素叠加到一起,透明通道处理抠像与叠加时的边缘信息,高动态范围扩展亮度层次,深度图为画面提供空间纵深信息,带颜色信息的深度数据则把深度与色彩一并输出。
这五项放在一起,覆盖的是从素材叠加、透明通道到空间深度的整段处理链路。Runway的表述是可以把更多管线搭在一个地方,官方并未展开每项能力的具体参数或使用方式,只给出能力名称与这一定位。扩展后的Workflows已经可用,消息发布时相关帖子的浏览量约两千余次。
选择这五项而不是别的功能,说明团队对使用者痛点的判断。合成与透明通道是后期的基础动作,几乎所有商业素材都要经过;深度图与带颜色的深度数据关系到画面里什么在前、什么在后,是空间关系处理的输入;高动态范围处理的是亮度范围,直接影响成片能否适配不同的播出标准。它们不是彼此独立的新玩具,而是同一条流水线上的相邻工位。
五项能力里,最值得展开的是深度相关的两项。生成模型产出的画面本质上是二维像素,模型并不真的知道哪个物体在前、哪个在后,它只是在概率分布上让画面看起来合理。一旦需要把生成素材与实拍素材合成,或者需要在后期调整焦点、加入景深、替换背景,就必须有可靠的深度信息作为中间量。
传统做法是用单独的深度估计模型对成片跑一遍,生成一张深度图,再导入合成软件使用。这条链路的问题在于两套工具对画面的解释可能不一致,边缘处的深度估计误差会在合成时变成可见的破绽,尤其是头发、半透明物体与快速运动的主体。
把深度图与带颜色的深度数据直接放进生成工作流,等于让深度信息与画面出自同一套理解,误差来源减少一个环节。对需要批量产出素材的团队,这意味着省掉了导出、导入、对齐的重复劳动,也意味着中间文件不再散落在多个目录里。
透明通道的意义类似。生成带alpha通道的素材,可以直接把主体叠到已有场景上,不必再做一次抠像。而抠像在毛发、玻璃、烟雾这类半透明边缘上最容易失手,省掉这一环,成片的边缘质量往往比后期抠出来的更干净。
高动态范围的价值常被低估。生成模型输出的画面亮度范围通常被压缩在标准动态范围之内,直接用于高亮度显示设备或与实拍素材混合时,高光容易溢出、暗部容易并阶。把HDR处理放进同一条流程,可以在生成阶段就保留更多亮度信息,减少后期补救的空间。
这次更新并非孤立动作。9月中旬,Runway还调整了面向创意团队的运营层面安排,推出统一定价方案,并为智能体化的创作流程加入实时内容审核层。两条消息放在一起看,方向是一致的:减少使用者在工具切换、成本核算与合规检查上的摩擦,把产品定位从生成器推向可交付的生产环境。
统一定价解决的是预算不可预测的问题。按次计费的生成工具在试错阶段成本波动很大,团队无法提前给出报价,也就难以把它写进项目合同。把计费结构调整为可预期,是接商业订单的前提。
实时审核层的意义在交付侧。品牌方与平台方对内容的合规要求越来越细,如果审核发生在成片之后,返工成本会很高;把审核前移到创作过程中,问题可以在生成的环节就被拦下,而不是等到客户看到初稿。
三条动作合起来,构成了一个清晰的取舍:不追求在单次生成质量上压过所有对手,而是把工具链的完整度与可管理性做成差异化。这条路线对专业团队更有吸引力,因为专业团队的时间成本主要花在流程衔接上,而不是在生成那几秒。
从行业格局看,AI视频的竞争正在从单点能力转向流程覆盖。榜单上头部模型的得分差距在缩小,文本到视频、图像到视频、视频编辑三个方向的排名经常在几周内互换。当生成质量不再有明显代差,谁的流程更少断点、谁的成本更可预测、谁的合规能力更完整,就成为采购决策的实际依据。
这也解释了为什么生成模型厂商都在往后期延伸。素材生成只是影视与广告流程的前段,后面还有合成、调色、特效、剪辑、多版本导出等大量环节。把其中几环收进同一套系统,就能把用户留在自己的界面里,而不是让他生成完就转到别的软件。
风险在于边界管理。管线越长,产品越容易在单个环节上落后于专业软件,尤其是合成与调色这类高度依赖精细控制的工作。把能力收进流程的价值,取决于这些能力本身是否达到可交付标准,而不只是能不能用。官方这次没有公布参数细节,实际质量还需要用户上手验证。
对国内的视频生成团队,这个方向有直接参考价值。国内在单点生成能力上追得很快,但在流程衔接上的投入相对少。把深度、透明通道、动态范围这些中间量标准化输出,比再提升几个点的画面质量更能提高实际使用率,因为它决定的是素材能不能被用进真实项目。