Google DeepMind · Veo 3 · 2025 年 5 月

Google Veo 3 — 面向原生声画与电影感短片的视频模型

Google Veo 3

Google Veo 3 是什么?

Google Veo 3 是 Google DeepMind 在 2025 年 5 月发布的主力一代,官方以「Video, meet audio」强调原生生成环境声、对白与画面。常见单段约 4–8 秒,适合电影感广告短片与叙事试片。相对后续 Veo 3.1,图生一致性与延长、首尾帧等控制较简;若项目已在 Veo 3 验证且够用,可继续沿用。需要更强参考控制时再对照 3.1。在 iMini 视频工作台选择 Veo 3 即可使用。

厂商
Google DeepMind
发布
2025 年 5 月
单段时长
常见约 4–8 秒
分辨率
常见 720p / 1080p
原生音频
支持;画幅常见 16:9 / 9:16
适合作为
原生声画的电影感短片

原生声画同出

环境声、对白与画面由同一条链路生成,是这一代最先该看清的能力。适合需要声画一体、减少后期贴轨的叙事短片。

电影感镜头语言

提示跟随与电影感构图表现突出,适合广告段、概念短片与需要明确景别变化的交付。

Google 生态习惯对齐

团队已在 Gemini、Flow 或 Vertex 栈里跑通流程时,提示与审片习惯迁移成本更低。

升级路径清楚

需要更强图生、参考图、延长与首尾帧时,对照 Google Veo 3.1;要快试镜时看 3.1 Fast 或 3 Fast。

和 Google Veo 3.1、Seedance 2.5 怎么选

三款都是当代主流视频模型。差别主要在世代能力、单段时长、参考控制与声画完成度。

对比项Google Veo 3Google Veo 3.1Seedance 2.5
单段时长常见约 4–8 秒常见约 4–8 秒,可延长原生约 30 秒直出
分辨率常见 720p / 1080p常见 720p / 1080p,更高档可选高清档位可选(以工作台为准)
原生音频原生声画是这一代核心卖点声画完成度与同步更强以工作台当前能力为准
多模态参考文生 · 基础图生(以工作台为准)图生 · 参考图 · 首尾帧 · 延长全模态多参考(官方约 50)
运动与物理电影感画面与声画优先电影感画面与提示跟随强更长段落一致性优先
更适合优先选用已在 Veo 3 验证、原生声画够用更强图生控制与延长定稿一次生成完整广告段 / 短剧桥段

优先选用 Google Veo 3

工作流已在 Veo 3 跑通、原生声画与电影感已满足交付,且暂不需要 3.1 级控制时。

优先选用 Google Veo 3.1

需要更强图生、参考图、延长与首尾帧,或要更高声画完成度时。

优先选用 Seedance 2.5

需要更长单段、更大参考规模,并把广告段一次生成出来时。

在 iMini 使用 Google Veo 3

从打开工作台到导出成片,三步即可开始。

01

打开视频工作台

进入 iMini 视频创作,选择 Google Veo 3。

02

写提示或上传参考

写清镜头、主体与声音意图;有静帧资产时可作为图生参考。

03

生成并导出

确认声画与节奏达标后导出。控制手段不够用时,对照 Veo 3.1 升档。

在 iMini 上使用 Google Veo 3

额度、规格与迁移。

在 iMini 免费生成 Google Veo 3

原生声画与电影感短片。打开视频工作台即可使用,无需单独厂商 API Key。

无需单独厂商 API Key。