产品旋转
视觉灵感,非经验证的 Wan 2.5 输出
产品旋转
一个无声的产品演示,需要保持稳定的形状和简单的运动。
Prompt cue
一个高端瓶子在干净的桌面上缓慢旋转,柔和的演播室灯光,细微的阴影移动,排除扭曲的标志和额外物体。
Settings
图像转视频,1:1 或 16:9,5 秒
Expected motion
稳定的产品形状,平滑的旋转,干净的背景
使用 Wan 2.5 生成高质量AI视频。支持反向提示词精准控制画面、智能提示词扩展、灵活宽高比,适配各类平台。
运动灵感
这些片段来自AI视频画廊的视觉灵感。可用来规划镜头语言、节奏、构图和提示方向。除非明确标注为模型验证输出,否则它们并非经过验证的Wan 2.5输出。
镜头节奏
提示提示:单场景运动,清晰的镜头移动,用于排除不需要的瑕疵的负向提示
在撰写最终提示前,决定镜头是否需要推拉、平移、环绕或固定不动。
提示提示:单场景运动,清晰的镜头移动,用于排除不需要的瑕疵的负向提示
根据主体、产品或角色需要保持可识别程度的强弱,选择文本、图像或参考引导输入。
输入路径:新场景使用文本转视频,起始帧控制使用图像转视频
在消耗积分前,围绕目标用途确定宽高比、时长、分辨率和音频预期。
规划画面:5 或 10 秒,720p/1080p,无声视频工作流
为何选择 Wan 2.5
Wan 2.5 适用于需要严格控制的无声视频草稿,其中负向提示、提示扩展、宽高比和起始图像的选择至关重要。
Provider
Alibaba
一个用于受控单场景生成的 Wan 视频模型页面。
Duration
5 或 10 秒
为社交、产品和解说类使用场景规划简洁的视频片段。
Resolution
720p/1080p
根据目标用途选择草稿或更高细节设置。
Audio
Silent
使用 Wan 2.5 制作无声片段;如需同步音频,请选择 Wan 2.6。
决定运行应从文字、图像还是更严格的提示排除开始。
Prompt-first
Prompt-first
视觉灵感,非经验证的 Wan 2.5 输出
当提示措辞、负向提示和宽高比足以定义场景时,使用文本转视频。
Frame-first
Frame-first
视觉灵感,非经验证的 Wan 2.5 输出
当起始构图应引导视频且提示应聚焦于运动时,使用图像转视频。
定价
透明的积分定价
5s / 720P
60
积分 每5s / 720P video
10s / 720P
120
积分 每10s / 720P video
5s / 1080P
120
积分 每5s / 1080P video
10s / 1080P
200
积分 每10s / 1080P video
将 Wan 2.5 视为一种受控的无声视频工作流,包含明确的排除项和紧凑的运动设计。
提示控制
最适合用于社交、产品和解说草稿,当期望的运动易于描述时。
图像控制
最适合静态图像、产品拍摄和构图,其中第一帧应被保留。
这些示例专注于受控的静音运动。它们是规划范式,而非经过验证的模型输出。
产品旋转
视觉灵感,非经验证的 Wan 2.5 输出
一个无声的产品演示,需要保持稳定的形状和简单的运动。
Prompt cue
一个高端瓶子在干净的桌面上缓慢旋转,柔和的演播室灯光,细微的阴影移动,排除扭曲的标志和额外物体。
Settings
图像转视频,1:1 或 16:9,5 秒
Expected motion
稳定的产品形状,平滑的旋转,干净的背景
竖屏社交视频
视觉灵感,非经验证的 Wan 2.5 输出
以手机为主导的开场,包含一个可读的动作。
Prompt cue
创作者展示手机屏幕,快速的手部动作,明亮的房间,中心构图,无多余手指,无文字伪影。
Settings
文本转视频,9:16,5-10 秒
Expected motion
清晰的主体,可读的动作,可控的伪影
解说时刻
视觉灵感,非经验证的 Wan 2.5 输出
用于着陆页或教育片段的简短无声视频。
Prompt cue
一个类似图表的物体在桌面上缓慢组装,缓慢的俯视镜头,干净的照明,避免杂乱和无法阅读的文字。
Settings
文本转视频,16:9,720p 或 1080p
Expected motion
简单的组装运动,稳定的构图,安静的视觉语言
照片动画
视觉灵感,非经验证的 Wan 2.5 输出
一张静态照片或插图需要微妙的生命力,但不改变其身份。
Prompt cue
用微风和轻微的头部转动动画化参考肖像,保持面部身份,柔和的自然光,无表情失真。
Settings
图像转视频,继承的宽高比
Expected motion
微妙的运动,可识别的主体,克制的镜头行为
使用此部分选择 Wan 2.5 进行受控无声生成,并避免过度解读共享画廊媒体。
输入路径
文本转视频和图像转视频是本页面的实际路径。
当第一帧控制至关重要时使用图像。
Duration
当前复制版本将 Wan 2.5 围绕 5 秒和 10 秒的视频片段进行设计。
保持运动足够简单,以便在一次短运行中评估。
Audio
Wan 2.5 被描述为一种无声视频工作流。
当需要同步声音时,请使用 Wan 2.6 或其他具备音频能力的模型。
媒体证明
除非明确标注为经验证的 Wan 2.5 输出,否则画廊媒体仅为灵感。
保持证明标签和替代文本保守。
Find answers to common questions about this model
Wan 2.5 是阿里巴巴推出的AI视频生成模型,通过反向提示词、智能提示词扩展和灵活的输出设置提供精准的创作控制。支持文生视频和图生视频两种模式。
反向提示词用于指定生成视频中需要排除的内容——比如不想出现的物体、风格或视觉瑕疵,帮助你更精细地控制最终画面质量。
开启后,AI会自动将简短描述丰富为包含光影、镜头运动和氛围的电影级详细描述。对于简短提示词特别有效,不需要时也可以关闭。
Wan 2.5 支持 5 秒和 10 秒两种时长,分辨率可选 720p 或 1080p。
文生视频支持 16:9(横版)、9:16(竖版)和 1:1(方形)。图生视频的宽高比由输入图片决定。
支持 JPEG、PNG 和 WebP 格式,文件大小不超过 10MB。上传的图片将作为生成视频的第一帧。
Wan 2.5专注于通过负向提示词和提示扩展实现精确的创意控制。如需受控的单场景生成,请选择2.5;仅在当前生成器控制无法满足所需工作流时,才使用更新的Wan工作流。
Wan 2.5 仅生成无声视频。如需音频同步功能,建议使用 Wan 2.6,它支持原生音视频同步。