Veo 3.1 AI 视频生成器
上传参考图片
JPG, PNG, WebP
Max 10MB
Veo3.1 允许你精确控制 AI 视频的开始和结束。使用 Veo3.1 的关键帧功能控制第一帧和最后一帧,创造流畅的电影级过渡效果并保持叙事流畅。
还没有视频
输入提示词并点击生成,使用 Veo3.1 的关键帧控制和原生音频创建你的第一个视频
Veo 3.1 视频示例
查看图生视频与文生视频示例,比较模型对运动、音频和视觉信息的处理。
Veo 3.1 图生视频
用来源图片确定初始构图,再通过提示词控制动作、运镜与声音。需要更多控制时,可加入结束帧或改用参考图工作流。

Veo 3.1 文生视频
使用镜头化提示词同时控制画面与声音。此示例指定快速跟拍、反光材质、正午光线、特写转场与科幻环境音。
"超快速跟踪镜头穿过广阔的未来城市,高耸建筑由反射性有机铬构成,在明亮的正午阳光下闪耀。相机在建筑之间动态穿梭,彩虹耀斑和晶体散景掠过画面。镜头转入半透明铬制蜂巢的特写,一只精细的机器人工作蜂以机械般准确的动作工作。高细节电影光线、浅景深,背景传来低沉的科幻环境嗡鸣。"
Veo 3.1:更可控的 AI 视频生成
通过多种视觉输入控制镜头如何开始、如何结束,以及主体和风格如何保持一致。
首帧与尾帧控制
上传起始帧和可选的结束帧,定义视频的视觉路径,由 Veo 3.1 生成两者之间的运动。适合制作指定结尾、前后变化或有计划的镜头转场。
增强版 Ingredients to Video
提供最多 3 张人物、物体、场景或风格图片。Veo 3.1 能组合这些视觉素材,并更稳定地保留角色身份与背景细节,即使提示词较短也能生成更生动的结果。
原生同步音频
在生成视频的同时生成对白、环境声和动作音效。可直接在提示词中写明关键声音,例如一句对白、室内底噪、脚步声或特定环境音。
延长视频并保持视觉连续
用新的提示词继续此前由 Veo 生成的视频。Veo 3.1 会承接已有场景的视觉与叙事信息,让故事可以在一次生成之后自然延续。
原生 9:16、1080p 与 4K
无需裁切即可生成适合移动端的全画幅竖屏视频,也可选择横屏输出。兼容的 8 秒生成支持 720p、清晰度更高的 1080p 与 4K。
如何使用 Veo 3.1 AI 视频生成器
根据所需的视觉控制程度选择输入方式,再清楚描述运动与声音。
1. 选择生成工作流
可从文字开始、让图片动起来、定义首尾帧、添加最多 3 张参考图,或延长此前由 Veo 生成的视频。根据所需的视觉控制程度选择输入方式。
2. 按镜头写提示词
写明主体、动作、环境、运镜、光线、风格与声音。使用图片时,重点说明哪些内容需要运动、哪些内容需要保持一致,不必只重复图片中已经可见的元素。
3. 设置时长、画幅与分辨率
选择支持的 4、6 或 8 秒时长,设置 16:9 或原生 9:16,并在兼容时选择 720p、1080p 或 4K。生成后先检查结果,再进行延长、编辑或发布。
Veo 3.1 AI 视频生成器常见问题
了解 Veo 3.1 参考图、首尾帧、原生音频、4K、视频延长、生成成本与提示词写法。
与 Veo 3 相比,Veo 3.1 有哪些新能力?
Veo 3.1 进一步提升了提示词遵循、真实感和音画同步,并增加更多创意控制。Google 官方最新能力包括增强版 Ingredients to Video、首尾帧插值、原生 9:16、视频延长,以及兼容的 1080p 与 4K 生成。
什么是 Veo 3.1 Lite?
Veo 3.1 Lite 是 Veo 3 系列中较新的轻量模型。Google 将其定位为支持原生音频的高分辨率文生视频与图生视频模型,可生成 4、6 或 8 秒的 720p 视频,以及兼容的 8 秒 1080p 视频,但不支持参考图或视频延长输入。
Veo 3.1 的首尾帧如何工作?
上传起始图片,并按需添加结束图片,Veo 3.1 会在这两个视觉锚点之间生成运动。建议使用构图兼容的图片,并在提示词中说明预期过渡;输入图片会引导结果,但不会保证逐帧路径完全固定。
什么是 Ingredients to Video?
Ingredients to Video 使用最多 3 张参考图片,为人物、物体、场景或风格提供视觉信息。Veo 3.1 的增强版本能更稳定地保留角色身份和背景细节;使用参考图时,视频时长为 8 秒。
Veo 3.1 会随视频生成音频吗?
会。Veo 3.1 会随画面原生生成对白、环境声与音效。建议在提示词中明确写出关键声音和台词。生成式音频存在波动,发布前应检查时序、发音与内容。
Veo 3.1 可以延长视频吗?
可以。Veo 3.1 能用新的提示词继续此前由 Veo 生成的视频,让动作在原有内容之后延续。延长会保持原视频格式,并以 720p 处理,因此适合提前将初始镜头与后续段落规划成连续序列。
为什么角色一致性很重要?
角色一致性有助于观众理解故事,也能让品牌形象保持可识别。提供角度和光线兼容的清晰参考图,并说明必须稳定的特征。参考图能提高一致性,但不会锁死每个细节,也不能保证不同生成完全相同。
Veo 3.1 支持哪些生成方式?
Veo 3.1 支持文生视频、图生视频、首尾帧插值、最多 3 张参考图生成,以及延长此前由 Veo 生成的视频。Gemini、Flow、Gemini API 与 Vertex AI 提供的具体选项可能不同。
Veo 3.1 视频可以用于商业项目吗?
能否商用取决于你使用的 Google 产品条款,以及上传图片、品牌、人物和其他素材的权利状态。用于广告或客户项目之前应查看当前适用条款;AI 生成不会自动授予第三方内容的权利。
Veo 3.1 生成成本是多少?
价格会随使用入口、模型版本、分辨率与产品变化。生成前请查看 Gemini API、Vertex AI、Gemini 或 Flow 的最新费率,尤其是 1080p 和 4K 工作流。
如何写出更好的 Veo 3.1 提示词?
围绕一个镜头写明主体、动作、环境、景别、运镜、光线、风格与声音。使用图片时,说明哪些内容需要运动、哪些内容必须稳定;对白放在引号中,避免在一个短片中塞入多个无关场景。
Veo 3.1 适合初学者吗?
适合。初学者可先从简单的文字或单图提示开始;有经验的创作者则可加入首尾帧、参考图、随机种子,以及明确的运镜与音频方向。先确定一个清晰动作,再逐步增加约束。
为什么 Veo 3.1 生成失败?
失败可能来自 Google 的安全过滤、不支持的输入或参数组合、地区人物生成限制、临时服务错误,或来源素材不符合要求。查看返回错误与当前模型规格,再修改提示词、参考素材或设置。
Veo 3.1 生成需要多久?
Google 没有承诺统一时长。处理时间会受到模型版本、输入方式、分辨率、时长、使用产品与当前需求影响;高分辨率和复杂参考图工作流通常比基础生成更慢。
如何用 Veo 3.1 制作更长视频?
可使用视频延长继续 Veo 生成的片段,也可将故事规划成多个镜头后在剪辑软件中组合。重复使用相同的视觉素材、人物描述、服装、光线、配色与镜头语言,有助于提高连续性。
