Google Flow与Veo 3.1:AI视频编辑进入新时代
Google为Flow发布重大更新,搭载Veo 3.1,引入Insert和Remove编辑工具,全功能音频支持,将AI视频编辑从简单生成推向真正的创意控制。

Google刚刚发布了自平台上线以来最大的AI视频更新。搭载Veo 3.1的Flow不仅仅是生成更美观的视频。它是用AI进行编辑——插入元素、移除对象、延长片段——同时保持音频同步。在生成2.75亿个视频之后,Google表明视频编辑的未来是生成式的。
超越生成:编辑革命
过去一年,我们一直执着于生成质量。哪个模型能产生最真实的爆炸效果?谁处理物理更好?AI终于能正确渲染手指了吗?
这些问题仍然重要。但Google提出了一个不同的问题:生成之后会发生什么?
答案显然是Flow。
Flow自2025年5月上线以来已生成超过2.75亿个视频。新的Veo 3.1更新将其从生成工具转变为完整的创意编辑套件。
传统视频编辑是破坏性的。你剪切、拼接、叠加、渲染。进行更改意味着重新渲染。添加元素意味着找素材、抠像、合成。
生成式编辑颠覆了这一切。想在场景中添加一只飞翔的鸟?描述它。想移除背景中那个分散注意力的标志?告诉AI。它会处理阴影、光照和场景连续性。
Veo 3.1为Flow带来了什么
让我们详细分析实际功能,因为新闻稿隐藏了一些真正重要的特性。
Insert:向现有场景添加元素
这是核心功能。现在你可以向生成或上传的视频片段添加新的对象或角色。
输入:一条宁静的森林小道,斑驳的阳光
Insert命令:"一只鹿穿过小道,停下来看向镜头"
输出:鹿自然出现,阴影准确,光照一致系统自动处理困难的部分。阴影方向与场景光照匹配。插入的元素与现有对象正确交互。这不是合成——而是将你的添加融入后重新生成场景。
Remove:删除不需要的元素
即将在Flow中推出的Remove功能允许你从场景中删除对象或角色。AI会重建其后面应该有的内容。
这比听起来更难。当你从场景中移除一个人时,你需要:
- 理解背景应该是什么样子
- 处理他们投射的任何阴影或反射
- 保持跨帧的时间一致性
- 使移除不可见——没有伪影,没有奇怪的模糊
传统VFX团队在干净底板工作上花费数小时。生成式移除在几秒内完成。
全功能音频支持
这是被低估的更新:音频现在可以与之前静音的功能配合使用。
| 功能 | 之前 | 现在 |
|---|---|---|
| Ingredients to Video | 静音输出 | 生成音频 |
| Frames to Video | 静音输出 | 生成音频 |
| Extend | 音频可选 | 完整音频集成 |
Ingredients to Video允许你组合多个参考图像来控制角色、对象和风格。现在这些生成的视频带有同步音频——环境声、对话、效果。
Frames to Video在起始帧和结束帧之间生成无缝过渡。以前你得到流畅的视觉变形,但必须之后添加声音。现在音频与视觉自然一起生成。
Extend允许你将片段延长到原始时长之外。通过音频集成,你可以创建一分钟或更长的视频,保持一致的声景。
技术飞跃
使这成为可能的是Veo 3.1相对于前代的改进。从我的实验来看:
基于Veo 3.1文档和测试的性能特征
关键创新:
逼真纹理:Veo 3.1比任何之前的版本更好地捕捉真实表面。皮肤、织物、金属、玻璃——纹理对光照变化正确响应。
增强叙事控制:模型更准确地遵循复杂提示。你可以指定情感节拍、时机、镜头运动,它真的会听。
更强的图像到视频保真度:将静态图像转换为视频时,Veo 3.1比Veo 3更好地保持角色一致性和场景保真度。
这如何改变创意工作流
我一直在为内容系列测试Flow,工作流的变化是显著的。
旧工作流:
- 写脚本
- 生成单独镜头
- 导出到编辑软件
- 手动添加音效
- 合成额外元素
- 每次更改都要不断重新渲染
Flow工作流:
- 写脚本
- 生成带音频的镜头
- 使用Insert/Remove优化
- 根据需要延长片段
- 导出最终视频
迭代循环崩塌了。你不再在应用程序之间切换。你不再手动同步音频。更改发生在生成发生的同一环境中。
与竞争对手的比较
AI视频领域竞争激烈。搭载Veo 3.1的Flow如何比较?
Runway Gen-4.5目前在纯生成质量上领先。Sora 2在物理理解更好的更长、更连贯片段上表现出色。
但两者都没有提供Flow刚刚引入的编辑功能。Insert和Remove是真正的新功能。全功能音频集成无可匹敌。
问题变成了:你需要什么?如果你正在为更大的制作生成单独镜头,质量可能是首要的。如果你在一个平台内创建完整视频,Flow的生态系统开始变得有吸引力。
实际用例
这在哪里真正重要?
社交内容创作:生成视频,意识到想在场景中添加产品,直接插入。无需重拍,无需合成。
原型可视化:用AI生成的视频向客户展示概念,然后在会议期间通过添加或移除元素实时迭代。
教育内容:创建讲解视频,之后可以插入图表、角色或视觉辅助。
营销素材:为广告生成B-roll,从库存素材中移除不需要的元素,延长片段以匹配音乐节奏。
访问Flow
Flow通过多个渠道提供:
- flow.google:主要Web界面
- Gemini API:供在Veo 3.1上构建的开发者使用
- Vertex AI:供需要规模和SLA的企业客户使用
- Gemini应用:通过Google的AI助手进行消费者访问
Insert功能正在推出中。Remove即将到来。音频集成已在所有支持的功能上可用。
这对行业意味着什么
我们正在实时观察"视频编辑"定义的改变。
传统编辑假设你有素材。你剪切、排列、增强它。素材是约束。
生成式编辑假设你有想象力。你描述你想要什么。AI生成、修改、延长。你的创意愿景是约束。
这还没有取代传统编辑器——目前还没有。高端电影制作仍然需要帧级控制、实际效果、真实演员。但对于绝大多数视频内容——社交媒体、营销、教育、原型设计——工具变得更加容易获取。
Flow上生成的2.75亿个视频只是开始。凭借与专业VFX软件相媲美的编辑功能,这个数字即将爆发。
立即尝试
如果你想亲身体验这种变化:
- 访问 flow.google
- 生成一个简单场景
- 使用Insert添加一个元素
- 观察AI如何处理阴影和光照
- 延长片段,注意音频如何保持连贯
然后尝试一些复杂的东西。生成一段对话,插入背景元素,用音频延长它。感受它与传统编辑的不同。
视频编辑的未来不是更好的剪辑素材工具。
而是描述你想要什么,然后看着它出现。
相关文章
继续探索这些相关文章

Google Veo 3.1 Lite:让每位开发者都能负担得起AI视频生成的API
Google通过Gemini API推出Veo 3.1 Lite,价格不到Veo 3.1 Fast的一半。在Sora退出、Runway转向世界模型的背景下,低成本视频生成终于成为独立开发者和初创公司的现实选择。

平台转向:为什么Adobe、CapCut和Google正在成为AI视频模型中心
AI视频竞赛不再是打造最佳模型的竞争,而是托管所有模型的竞争。Adobe Firefly现在捆绑了30多个AI引擎,CapCut刚刚嵌入了Seedance 2.0,Google Flow将生成与编辑合并。这就是为什么平台策略比任何单一模型都更重要。

AI视频编辑进入自动驾驶时代:Adobe、Google和NVIDIA如何重塑时间线
Adobe Premiere、Google Flow和NVIDIA RTX正在将AI直接集成到专业编辑工具中。时间线不再只是剪辑素材的地方,而是正在演变为一个智能工作空间。
