输入文本或图片,输出完整的视听场景。
Wan 2.5 AI 视频生成器
Add Image
JPG, PNG, WebP
Max 10MB
输出视频的画面比例将与你上传的图片一致
准备好创作了吗?
设置好参数,点击生成,开始创作精彩视频吧!
Wan 2.5 视频案例(含原生音频)
了解 Wan 2.5 如何将文本和图片转化为完整的视听体验
图片转视频(含音频)
将静态图片转化为动态视频,并同步配上音轨、语音和环境音效
Input

文本转视频(含原生音频)
仅凭文本描述,即可创作出包含视觉、语音和音乐的完整视频
Input
“夜晚昏暗的爵士酒吧,木桌在温暖的吊灯下泛着光。顾客们轻声细语地品着酒,一支三人乐队在舞台上表演。萨克斯手站在聚光灯下,闪亮的乐器反射着光芒。无对话。环境音:流畅的现场爵士乐,有萨克斯和钢琴声,玻璃杯碰撞声,观众低语声,偶尔传来附近桌子的笑声。镜头:缓慢地横摇过人群,然后轻轻推向萨克斯手的独奏,聚焦于他富有表现力的手部动作。”
使用 Wan 2.5 创作完整场景
Wan 2.5 将视觉生成与音频指导整合在一个专注的工作流中,适用于社交短片、概念视频、广告和故事片段。
视频与音频协调一致
在描述画面动作的同时,可指定对话、环境音、音乐和音效。Wan 2.5 会根据这些提示,塑造视听俱佳的结果,无需单独的音轨工作流。
文本转视频和图片转视频
需要全新构图时,从提示词开始;需要生成动画跟随现有主体、色调或布局时,上传图片作为参考。
灵活的输出控制
选择 5 秒或 10 秒时长,720p 或 1080p 分辨率,以及横屏、竖屏或方形的画面比例(在所选生成模式支持的情况下)。
更精准的提示词控制
使用负面提示词可减少不必要的元素,并在需要可重复的实验起点时,选择性地使用种子码。
如何生成 Wan 2.5 视频
通过三个简单步骤,将想法转化为可下载的视频。
1. 选择起点
选择“文本转视频”并描述场景,或选择“图片转视频”并上传清晰的参考图片。在提示词中包含主体动作、镜头方向、场景设置和音频提示。
2. 设置输出
选择适合发布平台的时长、分辨率和画面比例。仅在需要更多控制时,添加负面提示词或种子码。
3. 生成并预览
提交任务,预览最终结果,并下载视频。如果需要迭代,每次只更改一个提示词细节,以便观察场景的改进效果。
Wan 2.5 常见问题
关于 Wan 2.5 输入、输出设置、音频指导、提示词和使用方法的实用解答。
Wan 2.5 是什么?
Wan 2.5 是一款 AI 视频模型,用于通过文本提示或参考图片生成短视频。本工作区支持生成 5 秒或 10 秒的 720p 或 1080p 视频,提示词中可包含音频提示。
Wan 2.5 能否同时生成视频和音频?
是的。你可以在描述视觉场景的同一个提示词中,描述对话、音乐、环境音或音效。清晰具体的音频指令通常能帮助模型更好地实现你的目标。
Wan 2.5 支持哪些输入模式?
使用“文本转视频”从描述中创建场景,或使用“图片转视频”来为参考图片添加动画。当构图或主体外观很重要时,“图片转视频”模式非常有用。
我可以选择哪些时长和分辨率?
工作区提供 5 秒或 10 秒的生成时长,以及 720p 或 1080p 的分辨率。分辨率越高、时长越长,消耗的积分越多,处理时间也可能更久。
如何撰写 Wan 2.5 提示词?
请明确指出主体、动作、场景、镜头运动、视觉风格、光线和想要的音效。保持指令内部一致性,并将负面提示词用于你希望避免的特定元素。
生成的视频可以用于商业用途吗?
商业用途取决于你的套餐条款、服务提供商条款,以及你的提示词、上传内容、音乐指令、品牌和所描绘人物的权利。在发布商业作品前,请务必仔细阅读这些要求。
为什么两次生成的结果会不同?
生成式视频具有概率性,因此相同的提示词也可能产生变体。如果可用,请使用种子码,保持参考图片不变,并每次只调整一个指令,以便更可控地迭代。
探索更多 AI 视频
发现同类创作工具,让灵感自然延续。
将你的下一个创意转化为动态视听作品
选择文本或图片,清晰描述场景,即可生成可供预览和优化的短视频。
