
| 开发方 | Google DeepMind |
| 来源地 | 美国 |
| 发布日期 | Veo 3.1 · Oct 2025 |
| 原生音频 | 支持 |
| 最高分辨率 | 4K |
| 最长片段时长 | 8秒,可延长 |
| 开源情况 | 私有闭源 |
| 获取方式 | Gemini API · Flow · Vertex AI |
| 起价 | $0.05 / sec |
Veo 3.1 适合“主角镜头”——追求极致画质与同步声音。当画面精致度与分辨率最重要时,用它。
背景. 来自 Google DeepMind,Veo 3.1 于 2025 年 10 月发布,在 Veo 3 的原生音频之上,加入参考图控制、场景扩展与 4K。
打开 Vivideo,创建一个新视频。
选择 Veo 3.1 作为你的模型 — 或让 Video Agent 为你自动挑选。
描述你的镜头(或上传图片),并设置时长与画幅比例。
用 Veo 3.1 生成后,再精修、添加配音或数字人,并一键导出到任意平台。
每个模型都是 Vivideo 中 30+ 模型之一 — 逐镜头切换,只为拿到你想要的画面质感。








Veo 3.1 是 Google 顶级视频模型,以高保真、电影级输出与原生音频备受推崇。它在强提示遵循与逼真光影下渲染细腻场景,是当下最具照片级真实感的选择之一。
当你追求高端、精致的成片——品牌影片、广告与主角镜头,Veo 3.1 是首选。其写实感与音频能力,使作品看起来“像实拍”而非“像生成”。
Vivideo 将 Veo 3.1 与 Sora、Kling 等一并纳入同一方案,无需单独的 Google 人工智能订阅。用它完成“价值镜头”,再为过场切到更快的模型——全程不离开编辑器。
Veo 3.1 的文本到视频已经成为当前画质标杆:最多可输出 4K,光照、材质和音效可一次性生成。Ingredients 功能允许用最多三张参考图引导镜头,Scene Extension 在保持面容和服装一致性的同时延长 8 秒基础片段——这正是广告类素材在多次切换中需要的稳定性。图像到视频的用法相同:提供一张静帧和相机指向,结果看起来更像拍摄而非生成。
权衡在于成本与时长。4K 渲染价格更高且基础片段较短,所以这个模型更适合经过计划的拍摄而非即兴创作。想做松散的创意探索时 Sora 2 更具惊喜感;需要长镜头连续运动可考虑 Kling 或 WAN 2.6;追求更经济的大批量 4K,LTX-2 是更高效的选择。把 Veo 3.1 留给那些画面光彩可见的关键镜头——开场、产品特写、用户会截图保存的画面。
你可以在 Vivideo 上免费制作第一支 Veo 3.1 AI 视频——包含每日免费生成额度,无需 Gemini 订阅、Flow 访问或 Vertex AI 配置。在模型支持的情况下以 HD 或 4K 生成,然后在同一工作区完成:字幕、AI 配音、品牌套件和多场景剪辑可导出为最长 10 分钟的视频。
你可以在 Vivideo 上免费试用 Veo 3.1,无需信用卡。更高用量与进阶模型由付费方案覆盖。
支持 — Veo 3.1 可输出最高 4K 并带原生音频,是 Vivideo 上画质最顶尖的模型之一。
支持 — 在 Vivideo 上你可用 Veo 3.1 做文字转视频与图片转视频,并能按镜头切换到其他模型。
Veo 3.1 Fast 以少量画质换取更快且更省的渲染——适合打样;标准版 Veo 3.1 用于最终主镜头。二者均可在 Vivideo 使用。
基础片段为 8 秒,Scene Extension 可将镜头进一步延伸。对于完整视频,Vivideo 会把 Veo 3.1 的多个片段串成最长 10 分钟的剪辑。
不需要——Veo 3.1 集成在 Vivideo 中。无需 Gemini 订阅或 Google Cloud 配置;选择模型即可生成。