Google Veo 3 资料页
Google Veo 3 AI 视频生成器
这是一个基于一手资料整理的 Google Veo 3 与 Veo 3.1 指南。上方工作区目前只是临时占位,仍然使用本站首页已有的生成器,并不表示请求已经发送到 Google Veo 端点。
临时生成器占位说明
上方生成器会在 Veo 集成方案确定前复用首页工作区,因此它可能调用本站当前配置的视频模型,而不是 Google Veo 3。请使用下面的模型事实、提示词起点和官方链接来规划请求,不要把当前生成结果当作 Veo 3 输出。
Google Veo 3 如何进入实际视频工作流
Google Veo 3 是 Google 提供的一组生成式视频模型,可以通过 Google 产品和开发者平台使用。Google Cloud 官方文档将 Veo 3 的模型 ID 列为 veo-3.0-generate-001,并记录了文生视频、提示词重写和声音生成;在该端点中,图生视频被标注为预览能力。Veo 3.1 的 GA 生成模型使用 veo-3.1-generate-001,并进一步记录了图生视频、首尾帧过渡、视频延展和参考图工作流。不同端点的能力并不完全相同,因此使用 Google Veo 3 时,应在提交前核对平台、地区、发布阶段和准确的模型 ID。
一套可检查的 Google Veo 3 工作流程
当每次生成都回答一个明确的画面问题时,Google Veo 3 的结果更容易评估。先写一段短镜头说明,再明确输出设置,最后完整检查视频,而不是只看首帧就修改提示词。
- 01
先描述镜头
写清主体、可见动作、环境、机位、镜头运动、光线,以及必要的对白或音效。尽量描述观众能看到或听到的变化,不要用无关形容词填满提示词。
- 02
确认模型端点
确认请求使用 Veo 3 还是 Veo 3.1、准确的模型 ID、允许的输入模式、画面比例、分辨率,以及 4 秒、6 秒或 8 秒中可用的时长。
- 03
完整检查并迭代
检查运动、物理关系、人物、文字、连续性、音画时间和敏感内容。一次只改变一条指令,让下一次 Google Veo 3 结果能够回答一个清晰的问题。
Google Veo 3 与 Veo 3.1 能力对照
下面的表格把 Google Cloud 文档列出的事实和实际使用时的解释分开。只知道模型名称还不够,开发者真正能请求什么,取决于具体端点和发布阶段。
| 能力项目 | 官方记录 | 使用时如何理解 |
|---|---|---|
| Veo 3 模型 ID | veo-3.0-generate-001 | 请使用 Google 平台实际展示的准确 ID。预览 ID 与 GA ID 不能直接互换。 |
| Veo 3.1 模型 ID | veo-3.1-generate-001 | Google Cloud 将该生成端点列为 GA;Fast 和预览版本拥有不同的能力表。 |
| 视频模式 | 文生视频、图生视频、首尾帧、视频延展 | Veo 3.1 文档记录了更完整的组合。Veo 3 的图生视频属于预览能力,不能自动等同于 Veo 3.1 的所有工作流。 |
| 音频 | Veo 3 记录支持声音生成;Veo 3.1 需按端点确认 | DeepMind 产品页描述了 Veo 的原生音频,但不能据此推断每个 Google API 端点都开放相同的音频控制项,请查看准确的端点表。 |
| 视频时长 | 4 秒、6 秒或 8 秒 | Google Cloud 模型页列出了这些离散时长。更长的故事需要在支持的情况下使用延展等独立工作流。 |
| 画面比例 | 16:9 或 9:16 | 应先选择交付比例,再编写依赖画面边缘构图的镜头描述。 |
| 分辨率 | 720p、1080p;Veo 3.1 generate 记录支持 4K | Veo 3.1 fast 文档记录的输出为 720p 和 1080p。具体可用性可能受账户、地区和端点影响。 |
| 输出与帧率 | MP4;24 FPS | 模型文档列出 video/mp4 和 24 FPS。搭建自动化流程前应再次确认当前限制。 |
Google Veo 3 提示词起点
这些示例按照便于检查的视频 brief 组织:主体、动作、镜头、环境和声音。它们只是提示词起点,不保证得到完全相同的输出。
产品细节
16:9 · 8 秒 · 文生视频
产品近景:一只哑光黑色旅行杯放在石质桌面上,旁边是一扇明亮的窗户。镜头从左向右缓慢绕行半周,细细的蒸汽向上升起。柔和的晨光,真实反射,运动克制。加入轻微的陶瓷碰触声和房间底噪。不要可读的标志或文字。
对白与环境
9:16 · 8 秒 · 文生视频
竖屏中景:一位疲惫的自行车快递员在雨后的市场棚下停下。镜头保持视线高度,然后轻轻推进,快递员说:“街道还醒着。” 湿地反光,远处摊贩声,细雨,自然的对白语气。保持脸部和手部稳定。
参考图转场
16:9 · 8 秒 · Veo 3.1 图像工作流
使用提供的第一张图片作为开场构图,使用提供的最后一张图片作为结束构图。镜头连续穿过一间安静的工作室,午后光线逐渐变为黄昏。保持主体物体的形状和位置,转场符合物理关系,只加入克制的房间环境声。
使用 Google Veo 3 前要知道的限制
可靠的产品说明不仅要写能力,也要写边界。下面这些项目适合在创作或生产决策前逐项核对。
端点差异会改变能力
Veo 3、Veo 3.1、Fast 版本、预览端点、Gemini API 和 Google Cloud 可能提供不同控制项。务必阅读实际要调用的那个端点的模型表。
短片需要镜头计划
文档记录的单次时长是 4 秒、6 秒或 8 秒。需要更长时间的叙事,应设计成相互衔接的镜头,或在平台支持时使用延展工作流。
提示词语言与输入限制
Google Cloud 文档列出英文提示词、16:9 和 9:16 比例、图生视频路径下不超过 20 MB 的图像输入,以及每次请求最多返回四条视频。上线前请核对当前地区限制。
版权和质量仍需人工检查
原生音频、真实物理效果或高分辨率不会自动授予人物、声音、标志、音乐或参考图片的使用权。发布前请检查连续性、异常文字、安全过滤、内容凭证和供应商条款。
Google Veo 3 常见问题
Google Veo 3 是什么?
Google Veo 3 是 Google 的生成式视频模型系列。Google Cloud 文档标出 veo-3.0-generate-001,并记录文生视频、提示词重写和声音生成;对于该端点,图生视频被标为预览能力。
Veo 3 和 Veo 3.1 有什么区别?
Veo 3.1 是更新的文档产品线。其 Google Cloud generate 端点记录支持图生视频、首尾帧转场、视频延展和参考图工作流。具体控制项仍取决于使用的是 generate、fast、lite 还是 preview 版本。
Google Veo 3 可以生成音频吗?
Google 的 Veo 产品资料描述了原生音频,Veo 3 的 Google Cloud 表格也将声音生成列为支持项。对于 Veo 3.1,应查看准确的端点表,不能假设产品页能力会在每个 API 变体中以完全相同的方式开放。
Veo 3 视频最长多长?
Google Cloud 文档对记录的 Veo 3 和 Veo 3.1 生成端点列出 4 秒、6 秒或 8 秒。更长的连续内容需要支持的延展或剪辑流程,而不能默认一次生成一条长视频。
Veo 3.1 支持 4K 视频吗?
Veo 3.1 generate 文档列出 720p、1080p 和 4K 输出。fast generate 表格列出 720p 和 1080p,因此只有在具体端点和账户实际开放 4K 时,才应宣传 4K。
Google Veo 3 免费吗?
价格和访问权限取决于 Google 产品、API 账户、地区和当前活动。本页面不承诺免费生成。为项目做预算前,请查看 Gemini API 或 Google Cloud 当前的价格页面。
这个页面现在已经能生成 Google Veo 3 视频吗?
还不能。顶部生成器只是临时复用本站首页工作区,页面已经明确标注为占位,并不应被介绍为 Google Veo 3 集成。只有在单独的供应商实现完成并验证后,才能启用真实的 Veo 工作流。
资料来源与核验说明
本页面使用 Google 一手来源来整理模型 ID、支持模式、输出设置、发布阶段和功能描述。官方文档会随时间更新,因此在上线代码或引用价格前,请重新打开下面的端点文档核对。